OpenAI首席科学家对思维链监控(一种确保AI对齐的关键方法)的可靠性下降表示担忧。他指出了导致这种下降的三个主要原因,其中两个与AI模型的规模化有关。一个重要因素是故意转向潜在推理和循环Transformer,这使得AI的推理过程脱离了监控者通常分析的可观察令牌流。 AI
影响 随着模型规模的扩大和推理过程变得不那么透明,AI对齐和监管可能面临挑战。
排序理由 首席科学家对AI安全挑战的评论。
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →