PulseAugur
实时 08:13:59
English(EN) Querying Multimodal Scientific Papers with AI: Practices and Preferences Across Blind, Low-Vision, and Sighted Scientists

ChatGPT和Gemini等AI工具正被科学家用于多模态论文分析

一篇新发表在arXiv上的研究探讨了失明和低视力(BLV)科学家如何与ChatGPT和Gemini等AI工具互动,以理解多模态科学论文。研究人员采访了五位BLV科学家和五位视力正常的科学家,以确定当前的实践、可访问性解决方案以及对AI生成视觉内容响应的偏好。研究发现,模糊的描述和不正确的AI输出可能导致科学家放弃使用这些工具,并提供了一个包含115个查询和响应的数据集,以帮助未来研究开发更易于访问的AI驱动的科学问答系统。 AI

影响 这项研究强调了科学研究中对更易于访问的AI工具的需求,可能影响未来多模态问答系统的开发。

排序理由 该集群包含一篇学术论文,详细介绍了AI工具在科学文档分析方面的研究。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.AI 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

ChatGPT和Gemini等AI工具正被科学家用于多模态论文分析

报道来源 [1]

  1. arXiv cs.AI TIER_1 English(EN) · Arnavi Chheda-Kothary, Lucy Lu Wang, Joseph Chee Chang, Jonathan Bragg ·

    使用人工智能查询多模态科学论文:盲人、低视力及视力正常科学家的实践与偏好

    arXiv:2607.18514v1 Announce Type: cross Abstract: Visual diagrams, figures, and tables are central to scientific papers, and convey information beyond what is captured in text. While blind or low-vision (BLV) scientists have traditionally relied on static alternative text to acce…