DataCite
PulseAugur coverage of DataCite — every cluster mentioning DataCite across labs, papers, and developer communities, ranked by signal.
2 天有情绪数据
-
AI模型生成虚构“幽灵作者”,困扰学术出版界
来自三星和华沙大学的一篇新研究论文发现了一种现象:大型语言模型在各种语境下会持续生成相同的虚构专家姓名。这些由AI生成的虚拟人物,如Elena Vasquez和Elias Thorne,出现在数百篇学术论文、文章和书籍的作者列表中,导致学术出版记录被污染。研究发现,这些“幽灵作者”被Google Scholar和Semantic Scholar等聚合器索引,甚至在Zenodo等平台上被分配了数字对象标识符(DOI),这引发了对学术信息…
-
AI幻觉创造了虚假引文的相关作者组合
研究人员发现,当AI语言模型臆造引文时,虚构的作者姓名并非随机的。相反,这些模型会生成协同的合著者组合,其共同出现率高于偶然性,并且在不同生成中保持一致。这些虚构的记录,包括不存在的期刊和追溯的出版日期,被分配了真实的DOI,从而能够被学术聚合器摄取。
-
LLM创建的虚假作者身份困扰网络和学术出版
一项新的研究论文揭示,大型语言模型会生成相关的“幽灵”身份,例如Elena Vasquez和Marcus Chen,它们出现在大量AI生成的文档中,充当专家或合著者。这些相关的名称先验特定于模型家族和版本,留下了可检测的痕迹。研究发现,这些幽灵作者已被用于在Zenodo等存储库上创建超过1600条虚假的学术记录,并附有伪造的出版日期,还在ResearchGate等平台上形成了合成研究小组。
-
科学基础设施适应AI集成
科学界依赖于一个强大的基础设施来管理研究中的身份、来源和完整性。arXiv、DOI和ORCID等系统对于科学出版和知识传播至关重要。现有的这个框架现在正被改编以支持AI在科学发展中的集成,这类似于GitHub如何被重新用于AI开发。
-
AI 公司使用开放科学数据引发合作与私有化之争
AI 公司广泛使用 arXiv、ORCID 和 PubMed 等开放科学基础设施进行研究。这种做法引发了关于这是否代表真正的合作还是科学知识私有化形式的疑问。文章认为,AI 公司的大量数据提取可能不可持续,并可能损害开放科学生态系统。