PulseAugur
实时 07:02:38
实体 FireRed-Image-Edit

FireRed-Image-Edit

PulseAugur coverage of FireRed-Image-Edit — every cluster mentioning FireRed-Image-Edit across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 3 条
  1. SIGNIFICANT · CL_157642 ·

    Microsoft 发布 Mage-Flow,一款紧凑型 4B 图像生成模型

    Microsoft 发布了 Mage-Flow,这是一款紧凑型 4B 规模的生成模型,专为高效的文本到图像生成和基于指令的图像编辑而设计。该模型通过协同设计的标记器 (Mage-VAE) 和多模态扩散 Transformer (NR-MMDiT) 实现了具有竞争力的质量,能够生成高达 2048 像素的原生分辨率图像。Mage-Flow 及其编辑变体 Mage-Flow-Edit 有基础版、RL 对齐版和 Turbo 版,与更大的模型相…

  2. TOOL · CL_93993 ·

    FireRed-Image-Edit 通过大规模训练推动基于指令的图像编辑

    研究人员推出了 FireRed-Image-Edit,这是一款用于基于指令的图像编辑的扩散 transformer 模型。该模型利用了庞大的 16 亿样本训练语料库,该语料库经过精心策划和筛选,包含超过 1000 万个高质量的图像生成和编辑任务配对。FireRed-Image-Edit 采用了多阶段训练流程,并引入了数据效率和优化的新颖技术,包括非对称梯度优化和可微分一致性损失。其性能在新建立的 REDEdit-Bench 上得到了验…

  3. RESEARCH · CL_20322 ·

    开源图像编辑器展现出惊人的零样本视觉能力

    研究人员评估了三个开源图像编辑模型——Qwen-Image-Edit、FireRed-Image-Edit 和 LongCat-Image-Edit——在没有任何微调的情况下进行零样本视觉学习的能力。研究发现,这些模型在深度估计、表面法线估计和语义分割等任务上表现出显著的视觉理解能力。值得注意的是,FireRed-Image-Edit 在表面法线估计任务上的表现与一个指令微调模型相当,而 Qwen-Image-Edit 和 LongC…