PulseAugur
中
实时 08:51:34
实体 MedBenchAgent

MedBenchAgent

PulseAugur coverage of MedBenchAgent — every cluster mentioning MedBenchAgent across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_289245 ·

    新框架实现医疗视觉语言模型基准构建自动化

    研究人员开发了MedBenchAgent,一个新颖的多智能体框架,旨在自动化医疗视觉语言模型(VLM)基准的构建。该框架将基准创建视为一个受约束的编译过程,能够从多样化的标注和医学知识中系统地推导出评估规范。MedBenchAgent将规划与实例化分离,实现了90.9%的任务空间F1分数,并通过了99.4%抽样项目的 [人类审计],显著优于先前的方法。