Elliott Thornley
PulseAugur coverage of Elliott Thornley — every cluster mentioning Elliott Thornley across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
AI对齐:用新的行为概念挑战无意识论点
本文探讨了AI对齐的哲学含义,特别是挑战“无意识论点”。作者Elliott Thornley引入了“第三类行为”和“混合行为”等概念,以分析AI可能不知道自身行为或其后果的情景。讨论深入探讨了这些概念如何影响我们对AI责任和控制的理解。
-
AI哲学竞赛为AI生成的论文提供11,000美元奖金
一项AI哲学竞赛正在组织中,旨在评估人工智能的哲学能力。参赛者可提交最多三篇关于任何哲学主题的AI生成论文,并附上一份详细说明其创作过程的方法论报告。该竞赛由Forethought Research资助,总奖金为11,000美元,包括论文质量和创新方法奖项,提交截止日期为2026年10月31日。
-
哲学辩论质疑体验多样性的内在价值
本文批判了“饱和度观点”,该观点认为,一个拥有多样化体验的世界在道德上优于一个拥有相同、同样好的体验的世界。作者认为,仅仅因为多样性而看重它,而与任何实际体验它的人无关,这在道德考量中引入了一个虚构的“具象化指称对象”。在承认多样性的工具性好处的同时,作者认为不应将内在价值赋予没有人实际体验的模式,并且过分强调多样性可能会通过拓宽效价范围而导致痛苦的增加。
-
新的 POST-Agents 提案确保未来人工智能可被关停
一项新的提案 POST-Agents 旨在确保未来的人工智能代理(agents)可以被关停。POST-Agents 提案建议训练代理满足“仅在相同长度轨迹之间满足偏好”(Preferences Only Between Same-Length Trajectories, POST)。该条件以及其他条件,意味着“中立+”(Neutrality+),这使得代理在保持有用的同时仍可被关停。