实体
MMMU PRO
MMMU PRO
PulseAugur coverage of MMMU PRO — every cluster mentioning MMMU PRO across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 3 条
-
新的SD-MAR框架提升了VLM在多图像上的分析推理能力
研究人员推出SD-MAR,一个旨在增强视觉语言模型(VLM)在多图像分析推理能力的新框架。该框架利用通过受控扰动生成的合成数据,为变化检测和定量比较等任务创建场景。通过采用一种名为GRPO-lite with Backward Discounted Allocation的强化学习方法,在SD-MAR上训练的模型在领域内准确性方面显示出显著的改进,其中Qwen2.5-VL-7B在基准测试中超越了GPT-4.1。至关重要的是,这些改进并未…
-
NVIDIA 量化 Alibaba 的 Qwen3.6-35B 模型以实现高效部署
NVIDIA 发布了 Alibaba 的 Qwen3.6-35B-A3B 模型的量化版本,命名为 nvidia/Qwen3.6-35B-A3B-NVFP4。该模型使用 NVFP4 数据类型,将内存需求减少约 3.06 倍,同时在各种基准测试中保持了有竞争力的性能。它针对 AI 代理系统、聊天机器人和 RAG 系统进行了优化部署,并已准备好商用。
-
Chance AI 融资数百万美元,用于开发以摄像头为先的视觉AI代理
开发以摄像头为先的AI产品Visual Agent的初创公司Chance AI已完成数百万美元的天使轮融资。本轮融资由美图领投,NYX Ventures和阿里巴巴相关投资者参投。资金将用于增强模型能力,扩大在北美的用户群,并探索商业化。Chance AI的产品旨在超越简单的图像识别,通过理解用户意图并根据视觉输入提供建议或采取行动,目前已吸引约20万用户。