阿里巴巴集团的Qwen模型将实现显著扩展,计划中的Qwen4、Qwen4.5和Qwen5的参数量将在5T到10T之间,在此基础上,Qwen3.8的参数量为2.4T。该公司还专注于架构创新,以降低训练和推理成本,同时增加模型规模。阿里巴巴正在探索递归自我改进(RSI)以加速模型开发,实验表明Qwen参与芯片设计和优化推理基础设施。在多模态方面,阿里巴巴预览了将于11月推出的“Agent Video”模型,旨在实现更长、更可控、更智能的视频生成,同时升级图像、音频和音乐生成模型。 AI
影响 阿里巴巴的积极扩展和对AI驱动开发的关注可能会加速LLM的进步和采用速度。
排序理由 阿里巴巴集团的Qwen模型是前沿模型,此次发布详细介绍了其扩展计划和新功能。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
- Alibaba Group
- Anthropic
- Cloud栖 Conference
- Dario Amodei
- Kimi k3
- Li Feifei
- Liu Dayiheng
- Morgan Stanley
- Qwen
- Qwen 2.5
- Qwen 3.8
- Qwen 3.8-Flash
- Qwen 4
- Qwen 4.5
- Qwen 5
- Qwen-Audio-3.1
- Qwen-Image-3.1
- T-Head
- Wu Yongming
- Zheng Bo
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →