当前对人工智能对齐的关注,旨在确保人工智能系统遵循人类意图,正面临重大挑战。一个主要问题是,鉴于人类多样化且不断变化的价值观体系,很难就应该编码谁的意图达成一致。此外,即使是个人意图也可能无法代表他们真实的长远愿望。一个替代概念,即连贯推断意愿(CEV),提议将人工智能与人类在更知情和反思的情况下会想要的东西对齐,但这仍然是一个技术上和哲学上复杂的目标。 AI
影响 挑战当前人工智能安全范式,表明需要超越简单意图对齐的新方法。
排序理由 该条目是一篇讨论人工智能安全领域哲学挑战的观点文章,而非发布或事件。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →