PulseAugur
实时 06:13:10
实体 Genie 3

Genie 3

PulseAugur coverage of Genie 3 — every cluster mentioning Genie 3 across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 16
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 4
层级分布 · 90 天
主题
关系
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 16 条
  1. SIGNIFICANT · CL_204360 ·

    HelixWorld 1.0:发布实时交互式视听世界模型

    来自Noiz AI的研究人员与香港科技大学、清华大学等机构合作,推出了HelixWorld 1.0,一个新颖的交互式视听世界模型。该模型可实时生成24FPS的视觉内容和48kHz的立体声音频,并能动态响应用户操作。与之前生成静态视频或事后添加音频的模型不同,HelixWorld的Transformer架构从一开始就统一了音频和视觉生成,确保了同步且符合上下文的感官体验。研究团队计划在未来几周内公开模型权重和代码。

  2. RESEARCH · CL_161514 ·

    AMI Labs 筹集 10 亿美元用于“世界模型”,同时批评 LLM · 跟踪 1 个来源

    前 Meta 和 Nabla 的 Alexandre Lebrun 为他的新公司 AMI Labs 筹集了 10.3 亿美元,Yann LeCun 担任董事长。Lebrun 预测“世界模型”将成为一个普遍的热门词,但他认为这与当前的 LLM 存在根本性的架构分歧。他认为 LLM 缺乏对物理世界、持久记忆、推理和规划能力的理解,并引用了自回归的错误累积和文本对现实的有限表征。虽然“世界模型”一词被应用于生成视频预测和显式 3D 表示等各…

  3. TOOL · CL_157866 ·

    OpenAI因ChatGPT健康建议被起诉;Google Genie 3在游戏世界生成方面表现惊艳

    OpenAI因ChatGPT据称向一位牧师提供了关于肺栓塞的危险医疗建议而面临诉讼。另外,Google的Genie 3模型因其在创建游戏世界方面的出色视觉能力而备受关注,尽管其可玩性和趣味性是否超越了最初的新鲜感仍有待观察。

  4. SIGNIFICANT · CL_154865 ·

    昆仑万维发布Matrix-Game 3.5,实现AI与现实世界的交互

    昆仑万维发布了Matrix-Game 3.5,这是一款旨在弥合虚拟环境与现实世界之间鸿沟的世界模型。该模型解决了物体持久性、空间理解和因果推理等关键挑战,目标是实现人工智能在机器人和物理交互方面的应用。通过开发自动化数据处理流水线和优化推理速度,昆仑万维致力于使世界模型在现实世界应用中更加实用和可迁移。

  5. TOOL · CL_137590 ·

    开源 LingBot World 模型发布,提供互动霓虹城市体验

    一款新的开放世界模型 LingBot World 已发布,并提供公开权重,允许用户与一个实时霓虹城市环境互动。与 DeepMind 此前未发布的 Genie 3 不同,该模型可以在单个消费级 GPU 上运行,并支持施放法术等操作。然而,当玩家离开和返回时,模型会重新生成环境,这表明其记忆或状态持久性存在局限性。

  6. RESEARCH · CL_118323 ·

    世界模型初创公司融资超30亿美元,投资人押注模拟现实的AI · 跟踪1个来源

    2026年上半年,风险投资已向开发“世界模型”的初创公司注入超过30亿美元资金,这标志着投资重点已从传统的大型语言模型(LLM)转向。这些新的AI系统旨在模拟现实和理解物理环境,而不仅仅是处理文本。知名案例包括Yann LeCun的新公司,该公司获得了创纪录的10.3亿美元种子轮融资,以及Fei-Fei Li的World Labs,融资10亿美元。投资者认为,这些“物理AI”模型代表了AI堆栈中下一个可防御的层级,Nvidia和Ama…

  7. RESEARCH · CL_98969 ·

    AI 代理初创公司 General Intuition 寻求以 20 亿美元估值融资 3 亿美元

    专注于训练用于时空推理的 AI 代理的初创公司 General Intuition 据报道正在洽谈融资约 3 亿美元。这一轮融资将使该公司估值超过 20 亿美元,距离其最初的 1.34 亿美元种子轮融资仅过去八个月。该公司每年利用 20 亿个游戏视频的独特数据集来训练具身 AI 和世界模型,这一策略据称已引起 OpenAI 等主要 AI 实验室的兴趣。

  8. SIGNIFICANT · CL_83321 ·

    Decart 发布 Oasis 3,用于实时逼真驾驶模拟

    AI 初创公司 Decart 推出了 Oasis 3,这是一款新的交互式世界模型,能够实时生成逼真的驾驶环境。该模型可通过 API 使用,最初面向需要模拟罕见驾驶场景的自动驾驶汽车公司,并计划扩展到机器人和其他物理 AI 应用。Decart 旨在效仿 OpenAI 在语言模型方面的做法,围绕其世界模型构建开发者生态系统,并利用其高效的 Decart Optimization Stack (DOS) 提供具有竞争力的价格。

  9. TOOL · CL_79526 ·

    AI 逐帧生成可玩游戏世界

    AI 正在发展到一个可以逐帧生成整个可玩游戏世界的地步。Genie 3、Muse 和 Oasis 等新 AI 模型正在推动这一发展。游戏行业正在做出回应,随着 AI 驱动的游戏引擎的出现,Unity 提供了开发套件。

  10. TOOL · CL_77081 ·

    哥伦比亚大学教授提出用于机器人AI训练的“结构化世界模型”

    哥伦比亚大学助理教授李昀竹在ICRA 2026上提出了一种新颖的方法,提出了“结构化世界模型”(Structured World Models)作为机器人策略训练和评估的可扩展数据引擎。该方法旨在通过整合3D物理先验知识和广泛的2D数据学习,来弥合纯粹数据驱动的端到端模型与基于物理的模拟器之间的差距。提出的数字孪生框架能够高效、高保真地模拟机器人与环境的交互,与真实世界的机器人试验相比,显著加快了AI策略的测试和优化。

  11. TOOL · CL_70010 ·

    李飞飞将AI世界模型定义为渲染、模拟和规划

    李飞飞提出了一个框架来阐明AI中世界模型的定义,将其归类为三个核心功能:渲染、模拟和规划。她认为,虽然渲染侧重于视觉保真度,规划侧重于动作序列,但模拟是通过确保几何、物理和动态一致性来连接两者的关键桥梁。李还强调了这些功能在单一模型内融合的趋势,并提出一个统一的世界模型可以理解、想象、推理并与物理世界互动。

  12. RESEARCH · CL_32143 ·

    AI初创公司Recursive Superintelligence以6.5亿美元启动,致力于开发自我改进模型

    由Richard Socher和Peter Norvig联合创立的新AI初创公司Recursive Superintelligence已获得6.5亿美元融资。该公司旨在创建一个能够自主识别和修复自身弱点而无需人工干预的递归自我改进AI模型。他们独特的方法利用了开放性,并从生物进化和AI安全的“彩虹团队”等概念中汲取灵感。

  13. RESEARCH · CL_26040 ·

    阿里巴巴推出Happy Oyster世界模型,用于实时游戏开发

    阿里巴巴推出了Happy Oyster,一个专为实时交互和生成而设计的开放世界模型。该模型基于多模态架构构建,支持用户连续指令进行动态场景调整,并能生成具有赛博朋克美学等元素的游戏场景。虽然Happy Oyster在视觉一致性和实时响应能力方面展现出令人印象深刻的能力,但其在长期状态维护和精确控制方面的局限性表明,它更适合作为游戏开发原型制作的强大视觉工具,而不是传统游戏引擎的完全替代品。

  14. FRONTIER RELEASE · CL_00045 ·

    讨论 Gemini 3 Flash、Proto-AGI 以及 OpenAI 的计算挑战

    Google DeepMind 发布了 Gemini 3 Flash,这是一款新模型,揭示了其能力和潜在缺陷。Demis Hassabis 讨论了他对‘proto-AGI’的愿景以及人工智能发展的未来,涉及空间推理和最小 AGI 的概念。讨论还涵盖了计算放缓和新的数据范式,以及 Genie 3、Sima 2 和 Veo 3.1 等其他 DeepMind 的发布。

  15. FRONTIER RELEASE · CL_01722 ·

    Google DeepMind 的 SIMA 2 智能体在虚拟世界中进行推理和学习

    Google DeepMind 推出了 SIMA 2,这是一个先进的 AI 智能体,能够在虚拟 3D 环境中进行玩耍、推理和学习。SIMA 2 集成了 Gemini 模型,超越了简单的指令遵循,能够理解用户目标、进行对话并随着时间的推移提高其性能。这一发展代表着向通用人工智能迈出了重要一步,在机器人和具身 AI 领域具有潜在应用。

  16. FRONTIER RELEASE · CL_01729 ·

    Google DeepMind 的 Genie 3 为实时 AI 代理导航生成交互式世界

    Google DeepMind 推出了 Genie 3,这是一种新颖的世界模型,能够根据文本提示生成多样化的交互式环境。该模型允许用户以每秒 24 帧的速度实时导航这些动态世界,在 720p 分辨率下保持数分钟的一致性。Genie 3 在模拟自然现象、复杂交互甚至奇幻场景方面取得了重大进展,拓展了 AI 驱动的环境模拟的边界。