12:15官方账号arXiv cs.AI@Canjie Liu, Jiawen Kang, Jinbo Wen, Zishao Zhong78°RVSD是一种无需训练即插即用的解码框架,首次统一了令牌稀疏化和语义空间视觉检索。该框架在减少视觉幻觉方面达到最先进性能,在长上下文生成设置中保持强大的抑制能力。代码已在GitHub开源,可供研究人员直接使用。论文RVSD视觉语言模型视觉幻觉推荐理由:清华团队提出RVSD框架,不用训练就能减少大视觉语言模型的幻觉,效果还特别好。原文稍后读已读值得跟进有用关注 RVSD