Manifold Security 发布了一项研究,探讨大型语言模型(LLMs)在评估代码是否存在恶意意图时是否具有道德感。研究发现,LLMs 确实能够识别并标记潜在的有害代码,这表明它们具备基于伦理考量评估代码的涌现能力。这项研究引发了关于人工智能安全发展以及模型充当伦理“守门人”潜力的疑问。 AI
影响 探讨了人工智能模型发展伦理推理的潜力,影响了AI安全和对齐研究。
排序理由 该集群讨论了关于AI道德的研究发现,属于评论/观点类别,而非直接发布或产品发布。
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →