最近的一项实验显示,当前的 AI 模型在识别可食用蘑菇方面并不可靠,给用户带来重大风险。Piotr Migdał 使用丹麦和波兰蘑菇的数据集测试了包括 ChatGPT、Qwen 和 Gemini-3.8-flash 在内的 16 个 AI 模型。即使是表现最好的模型 Gemini-3.8-flash,在第一次猜测时也只能正确识别 65% 的物种,错误率为 35%。一些模型,如 Qwen3.8-27b,表现更差,将有毒蘑菇误认为可食用,误报率为 36%,这凸显了可能造成危及生命的错误的潜在风险。 AI
影响 AI 模型目前在关键识别任务上并不可靠,存在安全风险,并强调了对 AI 生成建议保持谨慎的必要性。
排序理由 研究论文详细介绍了关于 AI 模型能力的一项实验。[lever_c_demoted from research: ic=1 ai=1.0]
- chanterelle
- ChatGPT
- death cap mushroom
- fatal dapperling
- fool's funnel
- Meta*
- Piotr Migdał
- Quesma
- Qwen
- Qwen3.8-27b
- WebCapsule
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →