AMD发布了Instella-MoE,这是一款使用其自有GPU和软件开发的新型开源混合专家(Mixture-of-Experts)语言模型。该模型有多种形式可供选择,包括预训练、中度训练和微调版本,其训练代码和框架也公开可用。Instella-MoE拥有160亿总参数和28亿活跃参数,在某些基准测试中表现出竞争力,尤其超越了Gemma-4-E4B。 AI
影响 此举提供了一个具有竞争力的开源AI开发替代方案,可能加速AMD硬件和软件生态系统的采用。
排序理由 AMD,一家主要的硬件供应商,发布了一个新的开源AI模型。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
在 Mastodon — fosstodon.org 阅读 →
- AMD
- FarSkip-Collective
- Gemma-4-E4B
- Instella-MoE
- Instinct MI300X
- Instinct MI325X
- Primus
- Qwen3.5-4B-Base
- ROCm
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →