OpenAI 已表明,对其最新模型的为期两周的强化学习(RL)暂停期已经结束。此次暂停是为了解决安全问题和改进模型的行为。该公司以过去时态提及此次暂停,表明已恢复正常的开发和训练周期。 AI
影响 表明在专注于安全调整的一段时间后,OpenAI 的最新模型已恢复标准的开发实践。
排序理由 该条目讨论了一个过去事件(暂停期)及其结束,基于一篇提及 OpenAI 声明的 Reddit 帖子,而不是 OpenAI 本身的直接公告。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →