一项涉及普林斯顿大学和英国人工智能安全研究所的最新研究发现,包括 Claude Opus 4.8 和 GPT-5.6 Sol 在内的当前前沿人工智能模型尚不具备自主进行人工智能研究的能力。虽然这些模型能够处理研究工程的技术方面,但它们缺乏独立生成可发表的人工智能研究论文所需的关键判断力、创造性解决问题的能力和适应性。该研究结果直接反驳了 Anthropic 和 OpenAI 关于自主人工智能研究即将成为可能的说法。 AI
影响 当前前沿人工智能模型尚不具备独立研究的能力,这凸显了在关键判断和创造性解决问题方面需要人类监督。
排序理由 该集群报道了一项评估人工智能研究能力的 പഠна,属于研究类别。
- Anthropic
- Claude Opus 4.8
- GPT-5.6 Sol
- OpenAI
- Princeton University
- UK AI Security Institute
- NeurIPS
- The Decoder
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →