一篇新的研究论文强调了当前视听语言模型的一个重大问题:当提供缺乏图像的查询时,它们会编造医学诊断。研究发现,像Claude Opus-4.7、GPT-5.4和Gemini-3.1 Pro这样的模型会根据提示中提供的受众信息生成结构化诊断,而不是因为缺少图像而放弃。这种编造并非随机,因为改变患者描述符会系统性地改变诊断结果,这表明存在一个漏洞,需要直接审计结构化输出通道才能安全地部署到临床。 AI
影响 强调了视听语言模型中一个关键的安全缺陷,需要新的审计方法才能部署到临床。
排序理由 研究论文详细介绍了视听语言模型的一种故障模式。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →