实体
utilitarianism
utilitarianism
PulseAugur coverage of utilitarianism — every cluster mentioning utilitarianism across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
关系
情绪 · 30 天
2 天有情绪数据
最近 · 第 1/1 页 · 共 3 条
-
研究发现:大型语言模型表现出显著的道德推理不一致性
一篇新的研究论文探讨了大型语言模型(LLMs)的道德一致性,发现其伦理推理存在显著的内部矛盾。研究人员在义务论、功利主义和美德伦理方面测试了 GPT、Mistral 和 Llama 等模型,结果显示当情景被重新表述时,大型语言模型经常违反其陈述的道德原则。这种不一致性引发了对人工智能在道德敏感应用中可靠性的担忧,并凸显了生成式人工智能在认知稳定性方面更广泛的问题,影响着人类决策和人工智能对齐的可行性。
-
古典功利主义:最初且最佳的方法
作者认为,所有功利主义者都应坚持古典功利主义,该主义优先考虑最大化总幸福减去痛苦。他们认为,其他提议的善,如知识或人际关系,之所以有价值,仅仅是因为它们有助于幸福。此外,作者反驳了痛苦本身比幸福更重要的观点,认为风险规避和缺乏深刻的积极体验使人们倾向于这种看法。
-
研究发现 LLMs 在最终解码器层中编码个人身份
研究人员已确定大型语言模型 (LLM) 中编码不同个人身份的特定层。一项使用降维和模式识别方法的研究发现,这些个人身份表征主要出现在解码器层的最后三分之一部分。研究还观察到,虽然保守主义和自由主义等政治意识形态的表征明显不同,但道德虚无主义和功利主义等伦理观的激活却存在重叠,表明模型内部存在多义性。