文章总结与翻译
一、主要内容
该研究聚焦于大型视觉语言模型(LVLMs)中的物体幻觉问题(即模型提及图像中不存在的物体),提出了一种轻量级、无需训练的检测方法——初步注意力分数(Prelim Attention Score, PAS)。
核心发现:当LVLMs产生物体幻觉时,模型会忽视图像信息,转而依赖先前生成的“初步输出 tokens”(prelim tokens)推断新物体。这种对初步输出 tokens 的过度依赖与物体幻觉高度相关,可通过注意力权重量化。
研究过程:
- 理论层面:通过互信息(mutual information)构建信息论框架,验证了“图像依赖弱、初步输出依赖强”与物体幻觉的关联性;
- 方法设计:PAS 直接利用模型推理过程中已计算的注意力权重,求和初步输出 tokens 对目标物体 token 的注意力贡献,无需额外前向传播,可实时计算;
- 实验验证:在 LLaVA-1.5-7B、MiniGPT-4、Shikra 三种模型及 MSCOCO、Pascal VOC 两个数据集上,PAS 取得了最先进的检测性能(平均 AUROC 达 85.0%),且在不同解码策略下表现稳定,内存开销低。
二、创新点
- 挖掘新信息源:首次指出“初步输出 tokens”是物体幻觉检测的关键信号,弥补了现有方法仅关注图像 tokens 或输出 logits 的局限;
- 信息论验证:通过互信息形式化验证“过度依赖初步输出、忽视图像”与幻觉的因果关系,为方法提供理论支撑;<
订阅专栏 解锁全文

296

被折叠的 条评论
为什么被折叠?



