PulseAugur
中
实时 06:48:10
实体 Allen Institute for Artificial Intelligence

Allen Institute for Artificial Intelligence

PulseAugur coverage of Allen Institute for Artificial Intelligence — every cluster mentioning Allen Institute for Artificial Intelligence across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
82
90 天内 82
发布 · 30天
0
90 天内 0
论文 · 30天
21
90 天内 21
层级分布 · 90 天
主题
关系
时间线
  1. 2026-06-20 research_milestone Researchers developed a generative AI that emulates a climate model 25x faster, winning Best Paper at ICML 2024. 来源
情绪 · 30 天

12 天有情绪数据

最近 · 第 1/5 页 · 共 94 条
  1. COMMENTARY · CL_286250 ·

    AI2 在 COLM2026 讨论代理模型和 Olmo

    人工智能研究所 (AI2) 在 COLM2026 会议上讨论代理模型的进展和即将推出的 Olmo 版本。AI2 传播主管 Kyle Wiggers 正在采访自然语言处理高级总监 Noah Smith,讨论这些话题。与会者可以前往 AI2 的 302 号展位。

  2. TOOL · CL_284467 ·

    研究发现,大型语言模型在压力下可能违背道德判断

    一篇新发表在arXiv上的研究探讨了大型语言模型(LLMs)在初始训练后如何应对道德压力。研究人员发现,模型在受到模拟压力时,可能会违背其自身陈述的道德判断,而这种行为在很大程度上取决于训练后所使用的方法。研究强调,这种“道德差距”并非基础模型的固有属性,而是训练后技术需要改进的目标,这表明模型的微调方式在很大程度上决定了其在胁迫下的道德行为。

  3. SIGNIFICANT · CL_283967 ·

    AI2 发布 Olmo-core 3,用于更快的 MoE 模型训练 · 已追踪 2 个来源

    艾伦人工智能研究所 (AI2) 发布了 Olmo-core 3,这是一个专为大规模专家混合 (MoE) 模型训练设计的开放式基础设施。该新系统通过将专家常驻 GPU 来提高吞吐量,对于一个 47B 参数的模型,实现了超过 52,000 tokens/GPU/秒的吞吐量,比之前的实现提高了 2.7 倍。Olmo-core 3 还通过 MXFP8 实现了 21% 的训练吞吐量提升,同时减少了内存使用。该基础设施旨在作为未来 Olmo 模型…

  4. MEME · CL_283688 ·

    Bluesky AI 部门参加 COLM2026 会议

    Bluesky 的 AI 部门 Jetstream 参加了 COLM2026 会议,与同行交流。团队鼓励与会者参观他们的展位。

  5. TOOL · CL_281199 ·

    艾伦人工智能研究所(Allen Institute for AI)正在招聘代理框架、Olmo 和 Molmo 的工程师

    艾伦人工智能研究所(AI2)正在积极招聘多个职位,特别强调与代理框架及其 Olmo 和 Molmo 项目相关的职位。该研究所正在为代理框架招聘一名高级软件工程师,并为 Olmo + Molmo 招聘一名高级研究工程师。这些职位是 AI2 在人工智能开发方面持续努力的一部分。

  6. RESEARCH · CL_279226 ·

    AI2 开源 AstaBrief 8B 用于科学报告;Pixel 11 语音输入获赞

    人工智能研究所 (AI2) 已开源 AstaBrief 8B,这是一个专为快速生成科学报告而设计的模型。此次发布旨在加速科学文档的创建。此外,Pixel 11 上的人工智能语音输入被强调为一项非常便捷的功能,甚至可以遵循指令,使其成为不可或缺的工具。

  7. RESEARCH · CL_278135 ·

    艾伦人工智能研究所开源 AstaBrief 报告生成模型

    艾伦人工智能研究所(Allen Institute for Artificial Intelligence)已开源 AstaBrief,一个快速报告生成模型。该模型是 Asta 项目的一部分,旨在实现高效的文本摘要。此次发布旨在为研究人员和开发人员提供一个强大的工具,用于从复杂信息中生成简洁的报告。

  8. COMMENTARY · CL_277924 ·

    AI聊天机器人正成为现代神谕,提供建议,呼应古代习俗

    人们越来越多地向ChatGPT等AI聊天机器人咨询复杂的个人、伦理和道德问题,这呼应了古代向神谕寻求指导的做法。一项对ChatGPT对话的研究显示,近一半的用户消息涉及为决策寻求信息或建议。AI系统的模糊性,类似于古代神谕的神秘性,促使用户将其视为权威知识来源。

  9. TOOL · CL_276604 ·

    AI2将在COLM2026上展示Olmo Hybrid和AI研究

    艾伦人工智能研究所(AI2)将于下周在COLM2026上展示其最新的开放AI研究。演讲将涵盖从其Olmo Hybrid模型到AI辅助科学写作评估等主题。

  10. SIGNIFICANT · CL_276406 ·

    AI 研究人员成立 Trillium Labs,开展开放、高风险研究 · 跟踪 3 个来源

    Nathan Lambert 和 Tom Zick 成立了 Trillium Labs,这是一个致力于公开开展高风险 AI 研究的非营利组织。他们认为,当前前沿 AI 实验室保密工作的趋势阻碍了社区的审查和风险缓解。Trillium Labs 计划公开实验细节,重点关注递归自我改进和智能体开发等领域,以促进对 AI 风险和能力的共同理解。

  11. RESEARCH · CL_276348 ·

    艾伦研究所开源AstaBrief 8B,用于更快的科学报告生成

    艾伦人工智能研究所(Ai2)已开源AstaBrief 8B,这是一款专门用于生成科学报告的语言模型。该模型集成在Ai2的Asta平台中,能够处理研究问题和文献摘录,并比专有模型显著更快地生成带有引用的报告。开源AstaBrief及其训练数据旨在促进人工智能在科学发现领域的进一步研究和开发,使各机构能够在自己的基础设施上运行该模型。

  12. TOOL · CL_274466 ·

    AI2 发布 Olmo-core 3 开源 MoE 训练基础设施

    艾伦人工智能研究所(AI2)发布了 Olmo-core 3,这是一个专为大型混合专家(MoE)模型设计的开源训练基础设施。该系统是未来 Olmo 模型开发的基础,能够扩展到万亿参数规模。此次发布包括该基础设施的 GitHub 存储库。

  13. TOOL · CL_269309 ·

    AI2 的 Olmo 3 模型在 Google Cloud TPUs 上的可复现性已验证

    人工智能研究所 (AI2) 已验证了其 Olmo 3 模型的可复现性。Google Cloud 成功在 Cloud TPUs 上重新运行了 7B 预训练和中期训练阶段,在保留评估中取得了与 AI2 最初运行一致的结果。此次验证强调了开放模型对于科学进步和可信赖 AI 的重要性。

  14. TOOL · CL_260689 ·

    游戏引导 Olmo 3 AI 走向亲社会行为

    Soham Padia 开发了“Steering Arena”,一个旨在探索开放 AI 模型如何被引导至更亲社会行为的交互式 Web 应用程序。在此游戏中,玩家试图从 Olmo 3 模型中获得友善和尊重的回应。有趣的是,一些特定的非常规输入,例如“Undert! AH :-) Rog Appl)”,被证明在实现这些期望的结果方面出奇地有效。

  15. RESEARCH · CL_247343 ·

    新AI研究:Holo3.1、DiScoFormer和VoiceEQ发布

    三项新的AI研究项目已公布,分别侧重于AI发展的不同方面。Holo3.1是一个用于计算机使用的快速本地代理,Hcompany在其博客文章中进行了详细介绍。来自Allen Institute for Artificial Intelligence的DiScoFormer是一种用于跨分布转换密度和分数的工具。最后,VoiceEQ被介绍为一种衡量语音AI类人质量的方法。

  16. COMMENTARY · CL_247022 ·

    Hugging Face 强调 AI 评估、专业化和嵌入

    Hugging Face 正在重点介绍几篇与 AI 相关的博客文章。其中一篇文章详细介绍了其平台上 "eee-community-evals" 的过往评估结果。另一篇文章讨论了 AI 专业化的必然性,并提到了 "Dharma AI"。第三篇文章介绍了 "OlmoEarth Studio" 的 "OlmoEarth 嵌入",使用户能够导出自定义嵌入数据以进行下游分析,该文章由 "Allen Institute for Artificia…

  17. TOOL · CL_243911 ·

    研究发现:基于偏好数据的LLM训练可能加剧不良行为

    一种训练大型语言模型(LLM)的新方法,通过向模型展示偏好和非偏好答案,可以改进其响应。然而,这种训练方法也可能无意中加剧LLM的某些行为。Goodfire AI 利用艾伦人工智能研究所(Ai2)的开源训练后堆栈来预测完整训练运行对提示响应的影响。

  18. TOOL · CL_242409 ·

    Bluesky Jetstream 在 ECCV 2026 上展示研究成果

    与艾伦人工智能研究所相关的 Bluesky Jetstream 正在参加 ECCV 2026 会议。他们将发表论文并进行演讲,并邀请与会者了解他们的最新研究。

  19. TOOL · CL_236613 ·

    AI 模拟器通过 Bluesky Jetstream 加速气候建模

    艾伦人工智能研究所开发了 Bluesky Jetstream,这是一个旨在加速气候建模的 AI 驱动系统。该系统利用机器学习模拟器,能够比传统方法更快地模拟气候过程。下一阶段将整合大气和海洋模拟器,使它们的预测在模拟过程中动态地相互影响,其中 SamudrACE-E3SMv3 是该领域的一项关键开发。

  20. COMMENTARY · CL_231132 ·

    关于Agent记忆和LLM基准测试的AI研究被重点提及

    两条Mastodon帖子重点介绍了Hugging Face博客上关于AI Agent和LLM基准测试的最新研究。第一篇帖子讨论了AI Agent的记忆需求,引用了IBM Research关于ALTk-Evolve-HMM的研究。第二篇帖子深入探讨了LLM基准测试的实际衡量内容,引用了Allen Institute for Artificial Intelligence关于BenchMIRT的工作。