PulseAugur
实时 07:30:00
English(EN) 📰 Latent — Thinking Machines shrinks its flagship model to one GPU • Thinking Machines ships Inkling-Small, a 276B MoE that runs on one GPU • NVIDIA's Molt stri

Thinking Machines 发布 Inkling-Small,一个可在单 GPU 上运行的 276B MoE 模型

Thinking Machines 发布了 Inkling-Small,这是一个拥有 2760 亿参数的混合专家(MoE)模型,设计运行在单个 GPU 上。这一进展使得大规模 AI 模型能够更易于部署。该公告是更广泛的 AI 简报的一部分,简报还涉及了 NVIDIA 在智能体强化学习方面的工作以及其他行业发展。 AI

影响 通过降低硬件要求,使得大型 AI 模型能够更广泛地部署。

排序理由 这是一个非一线前沿实验室公司发布的模型,重点在于其可访问性(可在单 GPU 上运行),而不是突破性的性能声明。

在 Mastodon — fosstodon.org 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

Thinking Machines 发布 Inkling-Small,一个可在单 GPU 上运行的 276B MoE 模型

报道来源 [1]

  1. Mastodon — fosstodon.org TIER_1 English(EN) · [email protected] ·

    📰 Latent — Thinking Machines 将其旗舰模型缩小到单 GPU • Thinking Machines 发布 Inkling-Small,一个可在单 GPU 上运行的 276B MoE • NVIDIA 的 Molt stri

    📰 Latent — Thinking Machines shrinks its flagship model to one GPU • Thinking Machines ships Inkling-Small, a 276B MoE that runs on one GPU • NVIDIA's Molt strips agentic RL down to ~8.6K lines • Onton claims its search model beats Google Shopping and Amazon by 2.7x • Big Tech si…