Qwen Image Bench
PulseAugur coverage of Qwen Image Bench — every cluster mentioning Qwen Image Bench across labs, papers, and developer communities, ranked by signal.
2 天有情绪数据
-
LLaDA-Image 设定了图像生成领域新的开源SOTA
研究人员推出 LLaDA-Image,一个使用从头开始训练的 6B Diffusion Transformer 生成高质量图像的新颖框架。该模型利用纯图像预训练和专用优化器来实现照片级真实感结果和精确编辑能力。一个蒸馏版本 LLaDA-Image-Turbo 支持快速推理。LLaDA-Image 在 Qwen-Image-Bench 上设定了开源模型中的新最先进水平(SOTA),其权重、代码和训练方法已公开发布,以促进进一步研究。
-
LLaDA-Image:发布用于统一图像生成和编辑的开源模型
inclusionAI 发布了 LLaDA-Image,一个用于图像生成和编辑的开源统一模型。该模型系列包括一个用于高质量结果的 50 步基础模型和一个用于更快生成的 4 步蒸馏 Turbo 模型。LLaDA-Image 支持文本到图像生成、VQ 条件生成、参考图像编辑和多语言文本渲染,在 Qwen Image Bench 上取得了最先进的分数。
-
SenseNova 预览 U1.5 Lite 模型,支持 4K 生成和改进的文本渲染
SenseNova 发布了其 U1.5 Lite 模型的预览版,该模型包含多项关键更新,包括支持原生 4K 生成并增强细节,以及改进复杂布局的文本渲染。该模型还提高了处理长结构化提示的可靠性,并保持了本地化图像编辑功能。尽管承认在短提示理解和美学一致性等方面仍有改进空间,SenseNova 提供的基准测试显示其在图像编辑和文本渲染能力方面取得了显著进步。
-
阿里巴巴Qwen发布图像生成基准测试
阿里巴巴的Qwen团队发布了Qwen Image Bench,这是一个用于评估图像生成模型的新基准测试。该基准测试可在GitHub和Hugging Face上获取,但需要进行量化才能更广泛地使用。此举旨在为评估各种图像生成模型的性能提供一种标准化方法。
-
阿里巴巴的Qwen发布图像评估模型
阿里巴巴的Qwen团队发布了Qwen-Image-Bench,这是一个用于评估文本到图像生成视觉效果的视觉语言模型。该模型在Qwen3.6-27B的基础上进行了微调,根据包括质量、美学、与提示的对齐度、现实世界保真度和创意生成在内的一套结构化、分层标准来评估图像。Qwen-Image-Bench以JSON格式输出其评估结果,并利用链式思考推理提供详细分数。