研究人员开发了一种评估人工智能问责制的新方法,通过分析模型为辩护其决策所能构建的论证质量。该方法采用基于论证理论的四阶段辩证协议,以评估人工智能推理在多大程度上能经受住审查,尤其是在模糊的道德情境中。研究发现,虽然模型普遍能将其推理辩护到高于最低阈值的水平,但在提供充分的理由和证据支持其判决方面存在最大困难。值得注意的是,人工智能模型在事后辩护时,其推理方案往往与其最初的决策过程不同,这凸显了它们得出结论的方式与其解释方式之间存在差距。 AI
影响 这项研究引入了一个评估人工智能为其决策提供理由的能力的新框架,有望提高人工智能在复杂场景下的安全性和可信度。
排序理由 这是一篇详细介绍人工智能评估新方法的学术论文。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →