研究人员提出了一种新的衡量人工智能的方法,该方法超越了人类生成的提问。这种方法称为对抗性心理测量法,涉及人工智能参与者为彼此创建和解决问题,并为提问和解决问题都提供奖励。该方法旨在克服当前基准测试的局限性,这些基准测试难以跟上快速发展的人工智能能力,并且不需要外部人类评判。 AI
影响 提出了一种新的框架来评估人工智能能力,该框架可以超越人类的局限性进行扩展。
排序理由 该集群描述了一篇新颖的研究论文,该论文提出了一种评估人工智能智能的新方法。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →