PulseAugur
实时 18:30:27
实体 Poolside AI

Poolside AI

PulseAugur coverage of Poolside AI — every cluster mentioning Poolside AI across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 10
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
关系
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 10 条
  1. SIGNIFICANT · CL_212509 ·

    英伟达斥资60亿美元获得Poolside AI技术许可,收购109名员工

    英伟达已与AI初创公司Poolside达成一项重大的60亿美元许可协议,其中包括10亿美元的投资以及收购Poolside的109名员工。该协议允许英伟达在不进行正式合并的情况下获得Poolside的AI模型工厂软件的许可,从而可能规避反垄断审查。此举凸显了大型科技公司获取AI人才和技术的新策略。

  2. SIGNIFICANT · CL_159060 ·

    Poolside AI 的 Laguna S 2.1 在更小的体积下实现了卓越的性能

    Poolside AI 发布了其 Laguna S 2.1 模型,据称该模型比竞争对手的模型小 10 倍,但性能却更胜一筹。该模型是使用一个每月进行 10,000 到 20,000 次实验的“Model Factory”开发的。这种方法强调开放研究和自动化,以推动边缘 AI 的进步。

  3. SIGNIFICANT · CL_159033 ·

    Poolside AI 发布 Lagona S2.1,一款可在消费级硬件上运行的 118B MoE 编码模型

    Poolside AI 发布了 Lagona S2.1,这是一款拥有 1180 亿参数的混合专家(MoE)模型,专为开发者的本地部署而设计。尽管参数量巨大,但每个 token 仅激活其中一小部分,使其能够运行在 RTX 3090 或 MacBook 等消费级硬件上。该模型在编码基准测试中表现强劲,超越了 Gemini 3.5 Flash 和 Claude Sonnet 等模型,并能够生成复杂的应用程序和模拟。

  4. SIGNIFICANT · CL_158217 ·

    Poolside AI 发布 Laguna S 2.1,吹捧其快速模型工厂

    Poolside AI 发布了其 Laguna S 2.1 模型,据称该模型在性能上超越了规模近十倍的 Thinking Machines 模型。该公司联合创始人 Eiso Kant 讨论了他们的“模型工厂”方法,该方法能够快速进行模型训练和迭代,实验最快可在八周内完成。Poolside AI 强调开放权重和开放研究,Kant 表示他倾向于一个多元化的基础模型格局,而不是寡头垄断。

  5. SIGNIFICANT · CL_155809 ·

    Poolside AI 发布 Laguna S 2.1,一款拥有 1M 上下文的紧凑型编码模型

    Poolside AI 发布了 Laguna S 2.1,这是一款拥有 118B 参数的混合专家模型,其中 8B 参数被激活,并拥有 1M token 的上下文窗口。该模型在不到九周的时间内开发完成,在长时程编码基准测试中表现强劲,在同级别模型中超越了体积大其数倍的模型。Laguna S 2.1 在 Terminal-Bench 2.1 上获得了 70.2% 的分数,在 DeepSWE v1.1 上获得了 40.4% 的分数,所有评估…

  6. SIGNIFICANT · CL_100054 ·

    GLM-5.2 成为顶级开源 AI 模型,可与 GPT-5.5 相媲美

    开源语言模型 GLM-5.2 已引起广泛关注,多个来源表明其性能可与 GPT-5.5 和 Anthropic 的 Opus 4.8 等前沿模型相媲美。该模型具有架构改进,包括用于降低长上下文推理成本的 IndexShare,并通过 Hugging Face 和本地实现广泛可用。其他开源模型,如具有 256K 上下文窗口的 Laguna M.1 和 Cohere 的 North Mini Code,也已发布并进行了优化。

  7. RESEARCH · CL_34816 ·

    开源模型落后于前沿闭源模型,基准测试存在争议

    多家领先的 AI 实验室发布了新的开源模型,包括 DeepSeek V4、Gemma 4、Kimi K2.6 和 MiMo 2.5。CAISI 的一项评估表明,这些开源模型落后于前沿闭源模型,且差距正在扩大。然而,评估方法和基准测试的局限性也引发了争议,一些人认为标准化测试未能完全捕捉实际能力,尤其是在编码等复杂任务中。

  8. COMMENTARY · CL_28573 ·

    博客文章批评人工智能基准测试作弊

    Poolside.ai 上的一篇博客文章批评了人工智能开发中“基准测试作弊”的做法。文章认为,专注于为特定基准测试优化模型可能会导致系统在测试中表现良好,但在实际应用中却失败。作者认为这种趋势扭曲了进展,并鼓励对人工智能能力产生肤浅的理解。

  9. RESEARCH · CL_08454 ·

    Poolside AI发布开源权重代理编码模型Laguna XS.2和M.1

    Poolside AI推出了两款新的开源权重代理编码模型Laguna XS.2和M.1。这些模型在SWE-bench Verified基准测试中取得了令人印象深刻的分数,M.1达到72.5%,XS.2达到68.2%。XS.2模型是一个拥有330亿参数的模型,其能够在拥有36GB内存的消费级硬件上本地运行,这使得先进的编码助手更加易于获取。

  10. RESEARCH · CL_07734 ·

    Poolside AI 发布开源 Laguna XS.2 和 M.1 编码模型

    Poolside AI 发布了两款新的代理式编码模型 Laguna M.1 和 Laguna XS.2,以及它们的代理训练和运行时间。Laguna M.1 是一个大型混合专家(MoE)模型,在 NVIDIA Hopper GPU 上使用 30T 个 token 进行训练,而 Laguna XS.2 是一个较小的开源模型,可在 Apache 2.0 许可下使用。这些模型专为长周期任务设计,旨在实现能够编写和执行代码的更强大的 AI 代理。