PulseAugur
实时 21:23:56
实体 Lisette Elizabeth Espín Noboa

Lisette Elizabeth Espín Noboa

PulseAugur coverage of Lisette Elizabeth Espín Noboa — every cluster mentioning Lisette Elizabeth Espín Noboa across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_68400 ·

    新的基准测试审计大语言模型学者推荐和用户干预

    研究人员开发了LLMScholarBench,这是一个旨在审计用于学术专家推荐的大语言模型(LLM)的新基准。该基准评估了LLM的内在能力以及用户在推荐过程中干预的影响。在物理学专家推荐方面对22个LLM进行的实验表明,诸如温度调整、关注多样性的提示以及检索增强生成(RAG)等干预措施各有独特的权衡,影响着事实准确性、多样性和代表性等指标。

  2. RESEARCH · CL_56199 ·

    新基准揭示角色提示对LLM学者推荐的影响

    开发了一个新的基准来评估角色提示对用于学者推荐的大型语言模型(LLM)的影响。该研究审计了六个科学学科的43个LLM,分析了语言、地点和角色与任务提示的变化如何影响推荐的技术质量和社会代表性。研究结果表明,虽然模型选择主要影响技术质量,但提示设计显著影响多样性和事实性,特定的地点提示在准确性和同质性方面产生了不同的结果。