一位Reddit用户报告了Anthropic的Opus 5.5模型存在问题,发现它在化学和生物学相关任务中不可靠。尽管Opus在科学推理和编码方面有其优势,但用户经常遇到提示被拒绝的情况,这阻碍了它作为计算化学家工作的实用性。 AI
影响 突显了当前大型语言模型在专业科学推理方面存在的潜在局限性,影响了它们在特定专业领域的应用。
排序理由 用户对特定模型性能的反馈,而非官方发布或基准测试。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →
一位Reddit用户报告了Anthropic的Opus 5.5模型存在问题,发现它在化学和生物学相关任务中不可靠。尽管Opus在科学推理和编码方面有其优势,但用户经常遇到提示被拒绝的情况,这阻碍了它作为计算化学家工作的实用性。 AI
影响 突显了当前大型语言模型在专业科学推理方面存在的潜在局限性,影响了它们在特定专业领域的应用。
排序理由 用户对特定模型性能的反馈,而非官方发布或基准测试。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →
<!-- SC_OFF --><div class="md"><p>Has anyone else also experienced frequent rejection of model prompts for biology and chemistry related work? I’m a computational chemist and while opus is supposedly really good at scientific reasoning and coding, because it frequently rejects pr…