大型语言模型正日益成为医疗信息的主要来源,但对其训练数据的完整性的担忧正在上升。一项调查测试了像ChatGPT、Claude、Gemini和Grok这样的模型在德国、意大利和英国对堕胎相关查询的响应情况。结果显示,这些AI系统提供的信息存在显著的地区差异。 AI
影响 引发了对LLM在医疗等关键信息方面的可靠性的担忧,可能影响用户信任和安全。
排序理由 调查性报道,测试AI模型对敏感查询的响应。[lever_c_demoted from research: ic=1 ai=1.0]
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →