一项名为 InnovationEval 的新评估已被开发出来,用于测试 AI 模型独立发现新机器学习技术的能力。早期结果表明,尽管当前前沿 AI 模型拥有大量的计算资源,但在匹敌人类水平的算法创新方面进展有限。该评估旨在通过要求创建能改进特定指标的未见过的方法来验证 AI 的端到端研发能力,这模仿了人类科学发现的过程。 AI
影响 当前 AI 模型在独立算法创新方面存在困难,凸显了在自动化 AI 研发方面存在的差距。
排序理由 该集群讨论了一种用于评估 AI 研究能力的新评估方法,该方法发表在一篇出版物中。
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →