AI Safety Summit
PulseAugur coverage of AI Safety Summit — every cluster mentioning AI Safety Summit across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
OpenAI 因安全问题暂停 Astra 模型工作;Anthropic 保持进度
OpenAI 宣布因安全担忧暂停部分与其即将推出的 Astra 模型相关的工作,特别指出了潜在的网络安全风险和不匹配问题。这一决定与 Anthropic 形成对比,后者认为其目前的安保措施已足够,无需放缓。这种分歧凸显了两大领先实验室在准备潜在首次公开募股(IPO)时,在人工智能安全方面采取的不同方法,OpenAI 的首席执行官 Sam Altman 引用了在能力超越安全之前采取行动的必要性。
-
Reddit 讨论人工智能安全峰会
Reddit 上正在讨论人工智能安全峰会,用户分享了关于该活动的帖子链接。峰会旨在解决与先进人工智能相关的潜在风险和挑战。
-
Anthropic 警告 AI 风险,美国限制前沿模型
Anthropic 发布了关于人工智能递归自我改进(RSI)的研究结果,警告可能出现人类失控的风险,并建议暂停前沿人工智能的开发。与此同时,白宫已对 Anthropic 的新前沿模型 Fable 5 和 Mythos 5 实施了出口管制,禁止外国访问,并导致 Anthropic 关闭了这些模型。这些事件凸显了人们对人工智能能力日益增长的担忧,特别是开发自主网络攻击系统的能力,并强调了制定强有力监管的紧迫性,这与其他高风险行业的安全标准有相似之处。
-
美国和英国政府发布新的人工智能安全与监管政策
美国白宫于2023年10月30日发布了关于人工智能安全与发展的全面行政命令,该命令具有法律效力。随后,在2023年11月1日至2日举行的人工智能安全峰会上,英国政府发布了《布莱切利宣言》,包括美国和中国在内的人工智能领导者在内的29个国家签署了该宣言。这些政策文件标志着全球人工智能监管迈出了重要一步。