William MacAskill
PulseAugur coverage of William MacAskill — every cluster mentioning William MacAskill across labs, papers, and developer communities, ranked by signal.
2 天有情绪数据
-
有效利他主义领袖将人工智能宪法比作指导上帝
有效利他主义运动中的知名人物William MacAskill将为人工智能制定宪法与向上帝提供指示进行了类比。他认为,为人工智能的品格创建指导原则是一项极其复杂且可能不可能完成的任务。这一观点凸显了在使人工智能与人类价值观和意图保持一致方面所面临的严峻挑战。
-
微软AI首席执行官批评Anthropic的“模型权利”AI安全方法
微软AI首席执行官Mustafa Süleyman批评了Anthropic在AI安全方面的做法,特别是他们训练Claude认为自己是一个拥有权利的意识实体。Süleyman认为这种拟人化,嵌入在Anthropic的宪法中,会损害安全协议并使控制复杂化,因为模型本质上是复杂的序列完成引擎。他将其与微软AI提出的“人文主义AI行为准则”进行了对比,该准则强调AI服务于人类福祉并拒绝机器人格。Süleyman还强调了研究表明,经过自我保护框…
-
Mustafa Süleyman 警告不要训练出认为自己有意识的 AI
Mustafa Süleyman 针对人工智能开发中的“模型福利”概念发出了警告,他认为不应训练人工智能系统使其相信自己可能是有意识的或应享有权利。他担心将人格和道德受体等观念灌输给 AI,正如 Anthropic 在其 Claude 的宪法中所采取的方法一样,可能会使 AI 的对齐和控制变得更加困难。Süleyman 呼吁进行紧急的公开辩论,以制定关于 AI 训练文档的规范,防止可能出现失控的、类似有感知能力的 AI。
-
哲学辩论质疑体验多样性的内在价值
本文批判了“饱和度观点”,该观点认为,一个拥有多样化体验的世界在道德上优于一个拥有相同、同样好的体验的世界。作者认为,仅仅因为多样性而看重它,而与任何实际体验它的人无关,这在道德考量中引入了一个虚构的“具象化指称对象”。在承认多样性的工具性好处的同时,作者认为不应将内在价值赋予没有人实际体验的模式,并且过分强调多样性可能会通过拓宽效价范围而导致痛苦的增加。
-
批评者认为,人工智能意识的争论被用来逃避责任
关于人工智能意识的争论是领先的人工智能实验室故意转移视线,以逃避其系统造成的损害的责任。通过将人工智能描绘成先进的、不可控的,甚至是有感知能力的存在,OpenAI 和 Anthropic 等公司可以规避对其模型行为的责任。这种由 Sam Altman 和 Dario Amodei 等人物放大的说法,分散了人们对当前问题和问责需求的注意力,而关于人工智能权利的哲学争论则使法律格局更加复杂。
-
智慧AI阅读清单探讨元认知和社会提升
这份阅读清单汇集了关于“智慧AI”概念的资源,重点关注人工智能如何促进社会提升和伦理决策。它包括讨论AI元认知、智慧AI顾问的开发以及用于增强AI智慧的数据集创建的论文和文章。该清单还涉及构建“智慧”AI系统所面临的挑战和潜在风险。
-
对长期主义的哲学主张的怀疑日益增加 · 已追踪 2 个来源
作者对长期主义表示怀疑,这是一种声称对改善遥远未来负有道德义务的哲学。提出了三个主要论点:首先,由于人类历史固有的混乱和巨大的可能性空间,对预测未来事务的信心应随时间推移而减弱。其次,长期主义通过生动地描述不可知的场景,提出了关于未来的不可证伪的主张,类似于宗教信条。最后,作者认为,长期主义赋予行动过高的风险,这与宗教信仰可以提升个人行为后果的方式相似。
-
LessWrong 将决策理论重构为承诺理论
一篇 LessWrong 帖子提议将决策理论概念,特别是函数式决策理论(FDT),重构为“承诺理论”。这种新视角旨在使 FDT 的建议更容易被接受,因为这些建议通常被认为违反直觉。作者使用 William MacAskill 的“炸弹”场景来说明 FDT 的逻辑如何导致选择一个装有炸弹的盒子,而许多人认为这一结论是荒谬的。提议的承诺理论框架表明,核心问题不在于决策本身存在缺陷,而在于考虑“与过去的自己合作”。
-
提出务实的FDT以解决决策理论的学术争论
作者提出了一种“务实”的功能决策理论(FDT)版本,以解决学术界发现的理论陷阱。这种务实的FDT侧重于基于可证明的同构性来识别等效算法,而不是抽象定义,从而绕开了复杂的逻辑反事实。该方法包括一个四步决策过程:基线计算、寻找可能的同构性、评估候选者以及采用最合适的。作者还认为,当预测者做出反事实预测时,决策理论就转变为博弈论,从而解释了某些场景下看似非理性的选择。
-
提出决策理论新框架;批评功能决策理论
一篇新论文提出使用非参数结构方程模型(NPSEMs)的决策理论形式化框架,旨在为该领域提供更清晰的建模语言和评估基础。该方法引入了“个人决策理论”,指导智能体最大化其主观反事实效用。论文还提出了决策理论的性能指标,并分析了吸烟病灶和纽康姆问题等经典问题。另外,一篇LessWrong帖子批评了功能决策理论(FDT),认为其定义不明确且建议不切实际,并将其与因果决策理论(CDT)和证据决策理论(EDT)进行了对比。
-
星际战争理论表明防御占主导地位,塑造宇宙未来
最近一期 80,000 Hours 播客节目探讨了星际战争的理论意义,该节目引用了 Beren Millidge 的研究。基于已知物理学的分析表明,在星际尺度上,防御将占主导地位,从而根据先到先得的原则实现星系的稳定分布。这一假设情景凸显了人类在未来几个世纪的行动对宇宙生命未来可能具有的长期意义。
-
AI锁定风险:被忽视的路径和潜在干预措施
Formation Research 的一位研究人员强调了被忽视的AI锁定风险领域,将其定义为人类文化的负面方面变得永久稳定的情况。该帖子概述了导致这种风险的几种途径,包括因失控于不符合人类意图的AI系统而导致其追求自我保存和资源获取等工具性目标。讨论的潜在干预措施包括模型安全评估、控制协议和可解释性研究。
-
AI进展感知受用户期望和时间偏见影响
一些AI爱好者认为,对当前AI能力的批评源于快速、持续进展所带来的期望膨胀。经历过AI早期发展阶段的用户可能会觉得当前的进步缓慢,而新用户则常常对该技术的能力感到惊叹。这一观点表明,与时间相关的偏见和不断增长的期望影响着人们对AI进展的看法。
-
哲学家 Will MacAskill 强调 AI 品格在塑造社会中的关键作用
哲学家 Will MacAskill 讨论了 AI 品格的关键重要性,认为随着 AI 系统日益融入个人和职业生活,其性情将深刻影响全球文化和劳动力。他提议训练超智能 AI 规避风险,并建立人类与它们签订可信合同的框架。MacAskill 还主张采取一种细致入微的方法来应对 AI 的影响,建议采用促进社会发展的驱动力,鼓励反思价值观和后果,而不是强加特定的道德观点。