PulseAugur
实时 07:42:22
实体 BrailleBench

BrailleBench

PulseAugur coverage of BrailleBench — every cluster mentioning BrailleBench across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_223100 ·

    新基准测试 LLM 盲文理解能力

    研究人员开发了 BrailleBench,这是一个旨在评估大型语言模型 (LLM) 盲文理解能力的新基准。该基准包含数学、常识和问答任务中的 5,500 多个实例,同时使用一级和二级盲文。对六个 LLM 的初步评估显示,它们在英语语言能力与理解和生成盲文(尤其是二级盲文输入)的能力之间存在显著的性能差距。