Gwern Branwen
PulseAugur coverage of Gwern Branwen — every cluster mentioning Gwern Branwen across labs, papers, and developer communities, ranked by signal.
-
AI 作家 Gwern Branwen 推出初创公司;Apple 和 OpenAI 的戏剧仍在继续
Gwern Branwen,一位在 AI 安全和对齐领域颇有名望的作家,将辞去全职写作,推出一家名为 Guardian Angel Inc. 的新公司。此举标志着该领域从理论讨论转向实际应用。与此同时,9to5Mac Daily 的另一篇报道讨论了 Apple 和 OpenAI 之间关系的最新动态,突显了两大科技巨头之间最近的新闻以及潜在的合作或冲突。
-
AI研究者Gwern Branwen推出新公司Guardian Angel
以AI研究和写作闻名的Gwern Branwen宣布推出一家名为Guardian Angel的新公司。此举标志着他将从之前的全职写作和匿名活动中转型。尽管具体的产品和技术细节尚未披露,但由于一位在AI研究界有影响力的研究者的加入,这一消息已引起关注。
-
研究发现:大型语言模型比项目创建者更能识别项目
一项使用NameRank工具的研究发现,大型语言模型比它们的创建者更能识别项目。在测试的37个模型中,大多数都能识别出渔民与科学家研究协会(FSRS)及其创始人Jarrett Ye,但在没有明确提示的情况下,模型难以将Ye直接与FSRS联系起来。同样,一个名为Thoughts Memo的翻译小组,尽管在知乎上拥有大量粉丝,但只有一小部分模型能够识别它,没有一个模型能识别出其创始人。这表明,即使模型能够识别项目本身,但在将工作归功于个人…
-
人工智能安全焦点:形式化方法论文、Anthropic 和 OpenAI 招聘
一篇题为“通过形式化方法实现人工智能安全中的可处理问题”(Tractable Problems in AI Security via Formal Methods)的新立场文件已发布,重点关注人工智能安全方面最小化且无争议的方法,特别是通过加强基础设施来保护模型权重的机密性和完整性。作者还强调了 Anthropic 安全实验室的招聘工作,以及 OpenAI 的“Preparedness”团队可能对形式化方法的兴趣。此外,该帖子还引用了…
-
LessWrong 策展人分享关于审美理想、道歉和人工智能的链接
这篇 LessWrong 帖子是 2026 年 6 月份精选的链接和想法合集,重点关注工程和理性主义话题。它包括关于中国审美理想如何随社会经济地位而变化、对道歉的性质和意义的反思,以及关于牙科益生菌上市后测试挑战的简要更新。作者指出偏好以工程为中心的内容,并建议读者使用 LLM 来消化 Hacker News 文章的评论区。
-
AI 寓言隐写术在 Claude 短篇故事中得到探索
据报道,专注于 AI 生成短篇小说的 Unslop 竞赛正在探索 Claude 生成的“AI 寓言隐写术”概念。这表明 AI 生成的叙事中可能嵌入了隐藏或寓言式的含义,并在 LessWrong 等平台上引发了讨论。
-
提议使用屏幕录像作为AI用户模拟的可扩展数据
一种新方法提议使用连续的屏幕录像和用户输入数据来训练和评估旨在模拟个别用户的AI模型。该方法旨在捕获用户的偏好和知识,而无需大量的个人书面材料或手动数据标记。该系统记录用户的交互,例如浏览网站或阅读文档,以预测用户行为并个性化AI模型。
-
AI孵化器Surplus为公共利益初创公司提供10万美元种子资金
Surplus,一个由Manifund和Mox组织的孵化器,将于7月下旬在旧金山启动一项为期3个月的计划,以培养专注于在AI时代创造巨大公共利益的软件初创公司。该计划为人工智能在认识论和协调、面向公众的网站以及社区基础设施等领域的项目提供10万美元的种子资金、指导和人脉拓展机会。申请截止日期为6月24日,重点关注理想主义、足智多谋且致力于积极和解成果的创始人。