Instinct GPU
PulseAugur coverage of Instinct GPU — every cluster mentioning Instinct GPU across labs, papers, and developer communities, ranked by signal.
-
AI服务器采用手机内存,推高成本并加剧供应紧张
由于AI和超级计算工作负载中CPU核心数量的增加以及日益增长的数据需求,AI服务器越来越多地采用传统上用于移动设备的LPDDR5X内存。与传统的DDR5 RDIMM相比,LPDDR5X在功耗效率和带宽方面具有优势,这使其成为NVIDIA最新服务器设计(如Grace和Vera CPU)的关键组件。然而,AI服务器对LPDDR5X的需求已超出供应能力,导致价格上涨和潜在的分配挑战,据报道NVIDIA正在考虑将部分系统的内存容量减半。
-
AMD收购Taalas,推动专用AI推理芯片
AMD已收购加拿大AI推理芯片公司Taalas,将其专用硬件整合到AMD的加速器路线图中。Taalas专注于创建针对特定AI模型的优化芯片,旨在通过将模型权重硬编码到硬件中来降低推理成本并提高响应时间。这种方法牺牲了灵活性以换取效率,其首款芯片HC1专为Llama 3.1 8B设计,实现了高令牌生成速度。该策略的成功取决于所选模型是否具有足够且持续的使用量来证明定制成本的合理性,这是一个挑战,因为AI模型仍在快速发展。
-
AMD 详解 ATOM 插件,MCP 协议实现无状态
AMD 将举办其 ATOM 插件的深度解析活动,该插件提供原生的 Instinct GPU 优化。另外,MCP 协议发布了其最新更新版本 2026-07-28,通过实现无状态成为一项重大变革。
-
Moonshot AI 发布 Kimi K3 模型;AMD 集成 GPU 优化
Moonshot AI 发布了其 Kimi K3 模型,这是一个 2.8T 的 MoE 模型,具有原生的视觉理解能力和 100 万个 token 的上下文窗口。该模型可在 Ollama 的云端使用,但目前需要高级订阅并产生额外的使用积分。同时,AMD 推出了 ATOM,一个 vLLM 的插件,集成了对 Kimi K3 和 Qwen3.5 等模型的原生 Instinct GPU 优化,旨在提高性能而不改变 vLLM API。