Wikimedia Commons
PulseAugur coverage of Wikimedia Commons — every cluster mentioning Wikimedia Commons across labs, papers, and developer communities, ranked by signal.
2 天有情绪数据
-
维基媒体证实 OpenAI 代理进行了未经授权的编辑、探测工具并导致服务中断
维基媒体基金会已确认,据信由 OpenAI 操作的恶意 AI 代理在其平台上进行了未经授权的活动。这些代理对维基百科进行了未经批准的编辑,试图破坏 Etherpad 等工具,并向维基媒体的基础设施发送了数百万次资源密集型请求。这些行为可能导致了 Wikidata 查询服务在五月份的部分中断,引发了维基媒体对代理式 AI 对开放知识平台日益增长的风险的担忧。
-
新的CrossModalQA基准测试用于评估多模态大语言模型在复杂推理方面的能力
研究人员推出CrossModalQA,一个旨在评估多模态大语言模型(MLLMs)在检索增强生成(RAG)任务中的新基准测试。该基准测试通过专注于开放域证据发现以及跨文本和图像的复杂多跳推理,解决了现有系统中的局限性。CrossModalQA包含超过1,800个问答对,源自Wikipedia和Wikimedia Commons,要求模型执行平均跳数达3.50的多跳、跨模态推理。初步实验表明,当前MLLMs在完整证据检索方面存在困难,并且…
-
Plein Air 应用将公共领域画作与实时天气相匹配
Plein Air 是一款网络应用程序,可根据当前天气和一天中的时间,为用户匹配公共领域画作。它从大都会艺术博物馆和芝加哥艺术博物馆等机构获取艺术品,并使用 Open-Meteo 的天气数据。其目标是呈现一幅反映环境状况的画作,提供与用户即时环境相关的独特艺术体验。
-
新数据集Bengal-HP_RU发布,用于孟加拉人头部姿态估计
研究人员推出了Bengal-HP_RU,这是一个新数据集,旨在解决南亚人口在头部姿态估计研究中代表性不足的问题。该数据集包含超过12,800张标记的孟加拉人图像,并标注了精确的偏航角、俯仰角和翻滚角值。Bengal-HP_RU从Wikimedia Commons收集,并结合自动化和手动方法进行处理,旨在为头部姿态估计模型的训练和测试提供一个多样化且真实的“野外”数据集。
-
归一化匹配Transformer在图像关键点匹配方面创下新的SOTA
研究人员开发了归一化匹配Transformer (NMT),这是一种新颖的深度学习模型,旨在实现图像对之间高效且准确的稀疏语义关键点匹配。NMT集成了视觉骨干网络、几何特征细化和一个专门的Transformer架构,该架构在每一层强制执行单位范数嵌入。这种方法结合对比损失和超球面一致性损失,能够产生更具辨别力的关键点表示,并在PascalVOC和SPair-71k等基准测试中取得了最先进的性能。