Qwen团队发布了Qwen-Image-2.1,这是一个开源模型,集成了文本到图像生成和编辑功能。新版本采用更紧凑的7B参数DiT架构进行图像生成,原生支持透明图像生成(RGBA),并通过多图像输入和本地编辑增强了灵活性。该模型旨在平衡效率与通用性,部署需要特定的运行时vLLM-Omni,单独的vLLM不足以支持。 AI
影响 增强了统一图像生成和编辑的能力,可能提高创意应用的效率和灵活性。
排序理由 知名AI实验室(Qwen团队)的开源模型发布。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →