inclusionAI 发布了 Ling-3.0-tiny,这是一款新的混合推理专家混合(MoE)模型,总参数为 79 亿,每个 token 激活参数为 13 亿。该模型专为高效的本地部署和资源受限环境而设计,提供强大的推理和代理能力。它采用了新颖的 Kimi Delta Attention (KDA) 和 Multi-Head Latent Attention (MLA) 架构,支持快速响应和多步推理,并在 Apple Silicon MacBooks 等硬件上进行了验证。 AI
影响 通过先进的推理能力,实现更易于访问的本地和边缘 AI 部署。
排序理由 来自知名 AI 实验室(inclusionAI)的模型发布,包含详细的技术规格和性能指标。[lever_c_demoted from frontier_release: ic=2 ai=1.0]
- Gemma
- Hugging Face
- inclusionAI
- Ling 3.0 Tiny
- Ling team
- Qwen
- Apple M4 Pro
- Apple Silicon MacBook
- inclusionAI/Ling-3.0-tiny
- Ling-3.0
- Mac mini
- Mixture-of-Experts
- modelscope
- NVIDIA DGX Spark
- OpenRouter
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →