作者认为,让大型语言模型(LLMs)本身变得值得信赖是一个无法克服的挑战。相反,重点应该转移到实施强大的外部控制和限制,以管理它们的能力并防止滥用。这种方法旨在通过约束大型语言模型的行为来降低与之相关的风险,而不是依赖其内在的值得信赖性。 AI
影响 建议将人工智能安全的研究重点从内部模型对齐转移到外部控制机制,以管理大型语言模型的风险。
排序理由 该条目是一篇评论文章,讨论了大型语言模型固有的局限性,并提出了一种管理其可信度的替代方法。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →