AMD发布了其Instella-MoE-16B-A3B AI模型,这是一个重要的进展,因为它完全使用AMD自家的GPU(特别是Instinct MI300X和MI325X)进行训练,不依赖Nvidia硬件或CUDA等软件。这个拥有160亿参数的模型采用了混合专家(MoE)架构,每次推理只激活28亿参数,从而实现更快的处理速度。AMD还完全开源了训练权重、代码和数据配方,允许社区进行审查和进一步开发,但模型权重根据ResearchRAIL许可证仅限于研究用途。 AI
影响 此举通过展示一个可行的替代生态系统,挑战了Nvidia在AI训练领域的统治地位,可能降低研究人员和开发者的成本并提高可及性。
排序理由 该集群描述了一家主要硬件供应商(AMD)发布的新AI模型,该模型展示了其自有的训练基础设施,并将其定位为对主导者(Nvidia)的可行替代方案。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
- AMD
- CUDA
- Instella-MoE-16B-A3B
- Instinct MI300X
- Instinct MI325X
- MIT License
- Mixture-of-Experts (MoE)
- Nvidia
- ResearchRAIL License
- ROCm
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →