Instinct MI300X
PulseAugur coverage of Instinct MI300X — every cluster mentioning Instinct MI300X across labs, papers, and developer communities, ranked by signal.
3 天有情绪数据
-
AMD 预计 2026 年 AI 系统能效将提升 4 倍
AMD 更新了其机架规模 AI 解决方案的能效目标,目前预计到 2026 年其能效将比 2024 年的平台提高 4 倍。这一预测是公司更广泛的“20x2030 计划”的一部分,该计划旨在到 2030 年实现能效提高 20 倍。AMD 的估算包括了计算性能、工艺技术、内存和互连带宽、软件以及系统级协同设计的改进。公司强调,这些数据是基于其每瓦性能方法论的估算,结合了实际产品测量和模型化结果。
-
AMD推出Instella-MoE-16B-A3B,完全使用自家GPU训练
AMD发布了其Instella-MoE-16B-A3B AI模型,这是一个重要的进展,因为它完全使用AMD自家的GPU(特别是Instinct MI300X和MI325X)进行训练,不依赖Nvidia硬件或CUDA等软件。这个拥有160亿参数的模型采用了混合专家(MoE)架构,每次推理只激活28亿参数,从而实现更快的处理速度。AMD还完全开源了训练权重、代码和数据配方,允许社区进行审查和进一步开发,但模型权重根据ResearchRAI…
-
AMD 发布拥有 2.8B 激活参数的开源 Instella-MoE-16B LLM
AMD 发布了 Instella-MoE-16B-A3B,这是一款开源的专家混合(Mixture-of-Experts)语言模型。该模型拥有 160 亿总参数,但每个 token 仅激活 28 亿参数,利用了门控多头潜在注意力(Gated Multi-head Latent Attention)和 FarSkip-Collective 连接等架构创新,以提高训练和推理速度。虽然训练代码采用 MIT 许可且高度可重用,但模型权重是在 R…
-
AMD发布在自家GPU上训练的开源Instella-MoE AI模型
AMD发布了Instella-MoE,这是一款使用其自有GPU和软件开发的新型开源混合专家(Mixture-of-Experts)语言模型。该模型有多种形式可供选择,包括预训练、中度训练和微调版本,其训练代码和框架也公开可用。Instella-MoE拥有160亿总参数和28亿活跃参数,在某些基准测试中表现出竞争力,尤其超越了Gemma-4-E4B。
-
美国允许中兴通讯购买英伟达H200 AI芯片,跻身科技精英行列
美国政府已批准中国电信公司中兴通讯购买英伟达的H200 AI芯片。此举使中兴通讯得以加入包括阿里巴巴、腾讯和字节跳动在内的一批已获准采购英伟达Hopper代硬件的中国科技公司之列。然而,此次批准的实际影响可能受到中国自身国内芯片产业计划和监管障碍的限制。
-
OncoAgent 使用双层 LLM 为肿瘤学决策提供私密支持
研究人员开发了 OncoAgent,这是一个开源的肿瘤学临床决策支持框架,优先考虑患者隐私。该系统利用双层 LLM 架构和多代理 LangGraph 设置,并包含一个四阶段检索增强生成 (RAG) 管道。它将查询路由到速度优化的 9B 参数模型或深度推理 27B 参数模型,这两个模型都使用 AMD 硬件在大量的肿瘤学病例数据上进行了微调。