一位用户使用名为 GPT-6 Astra 的模型与国际象棋引擎 Stockfish 进行了一场国际象棋测试。在 Stockfish 的强度被限制在 1320 和 1500 的比赛中,GPT-6 Astra 赢得了所有四场比赛。然而,当 Stockfish 的强度增加到 1700 的限制时,GPT-6 Astra 输掉了两场比赛。该实验旨在作为对给定当前棋盘局面下决策能力的重现性测试,而非正式的 Elo 评分,所有方法和数据均公开可用。 AI
影响 测试表明,在对手受限的情况下,GPT-6 Astra 具有强大的国际象棋决策能力,但在面对更高强度的引擎时会遇到困难。
排序理由 该集群描述了特定模型在特定领域的能力测试,而不是主要 AI 实验室的发布或重大发展。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →