12:14官方账号arXiv cs.AI@Urja Pawar, Rajitha Ramanayake, Owen O'Neill, Nabeel Kemal, Abhishek Mandal, Houssem Chatbri, Christopher Martin精选73°研究人员提出两种互补信号检测黑盒大模型幻觉:语义熵和token不确定性。他们开发了TopK方法聚合token信号,CoCoA方法结合目标响应不确定性和语义相似性,以及Gated和Stacked两种监督方法。研究在7个基准上测试了4个语言模型,Stacked方法在近半数情况下表现最佳,TopK和CoCoA无需监督标签也具竞争力。论文LLMs幻觉检测语义熵推荐理由:这篇论文教你如何检测黑盒大模型的幻觉,有4种方法可选,无需监督标签也能用。原文稍后读已读值得跟进有用关注 LLMs