研究人员开发了检测大型语言模型和视觉语言模型中幻觉的新方法。UniProbe是一种用于大型VLM的技术,它使用图神经网络、Vision Transformer和门控循环单元来分析模型内部表示,并在token级别识别幻觉内容。Prompt Embedding Probes (PEP)是另一种方法,它通过可学习的提示嵌入来增强隐藏状态,以检测LLM中的幻觉。这两种方法都旨在提高检测准确性,而无需进行广泛的模型微调。 AI
影响 这些新的检测方法可以通过减少生成错误信息的实例,从而提高AI系统的可靠性和可信度。
排序理由 arXiv上发表了两篇研究论文,详细介绍了检测LLM和VLM中幻觉的新颖方法。
- arXiv
- GSM8K
- MedQA
- Prompt Embedding Probes (PEP)
- Qwen3
- TriviaQA
- alphaXiv
- CatalyzeX
- DagsHub
- gated recurrent unit
- graph neural network
- Hugging Face
- Large VLMs
- LLMs
- UniPROBE
- Vít
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →