Dutch
PulseAugur coverage of Dutch — every cluster mentioning Dutch across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
新的MARS-Gov框架可检测并缓解荷兰文件中的官僚偏见
研究人员开发了MARS-Gov,一个新颖的多智能体框架,旨在检测和缓解荷兰政府文件中的官僚偏见。该系统解决了现有方法面临的挑战,例如缺乏规范基础的分类器以及大型语言模型过度标记行政语言。MARS-Gov集成了法律检索、开放集目标筛选和一个动态的“第十名陪审员”来审议新兴偏见,在DGDB基准测试中以0.880的F1分数设定了新的最先进水平。
-
多语言NLP模型可检测有害和可验证的社交媒体帖子
研究人员开发了基于Transformer的多语言NLP模型,能够检测包含可验证事实声明和有害内容的社交媒体帖子。该研究涉及数据集收集、预处理、模型训练和测试,重点关注能够同时处理英语和阿拉伯语、保加利亚语、荷兰语、波兰语、捷克语和斯洛伐克语等低资源语言的模型。与最先进的方法相比,开发的这种多标签分类模型表现出了鲁棒性,能够同时高效地识别有害和事实可验证的帖子。
-
荷兰报纸大量使用人工智能撰写观点文章
荷兰主要报纸的观点文章中有很大一部分是由人工智能生成或辅助的。至少有 49 篇文章完全由人工智能创作,另有 57 篇文章部分由人工智能生成。这一趋势引发了对人工智能对公众讨论和新闻业诚信影响的质疑。
-
荷兰央行因地缘政治担忧将86吨黄金转移至伦敦
荷兰央行已将其86吨黄金储备从美国和加拿大转移至伦敦,理由是日益加剧的地缘政治动荡令人担忧。此举旨在提高黄金储备的部署能力和韧性,使其在危机情况下更容易获得。尽管被描述为一次性事件,但荷兰央行指出,如果其他央行效仿,此类行动可能会影响对美国的信心。
-
新的荷兰语数据集 WinoQueer-NL 揭示了语言模型对 LGBTQ+ 身份存在显著偏见
研究人员开发了 WinoQueer-NL,这是一个旨在评估荷兰语模型在 LGBTQ+ 身份方面偏见的新数据集。该数据集改编自英文 WinoQueer 基准测试,并通过对 43 名荷兰酷儿参与者的调查进行了验证,包含超过 42,000 个句子。使用各种荷兰语和多语言模型进行的初步评估显示,尽管平均偏见得分为中性,但特定模型表现出显著偏见,特别是针对跨性别者和非二元性别者,对跨性别身份的刻板印象句子偏好率高达 97%。
-
AI模型难以预测生育等人类生命事件
最近一项发表在arXiv上的研究探讨了重大人生事件的可预测性,特别是关注在三年内预测生育。该研究涉及147名参与者,他们使用了包括逻辑回归、大型语言模型和Transformer在内的各种方法来预测荷兰18-45岁居民的生育情况。虽然预测显示出中等准确性,但先进模型并未显著优于经典模型,而数据来源(调查与人口登记)对性能的影响有限。研究还估计了一个理论上的预测上限,表明生物过程中的固有随机性和未建模因素导致了精确预测个体人生事件的困难。
-
人工智能生成的观点文章出现在荷兰报纸上 · 已追踪 4 个来源
最近的一项调查显示,上个月在荷兰主要报纸上发表的至少 49 篇观点文章完全由人工智能生成。AI Report 平台报道的这一发现,凸显了人工智能在媒体内容创作中的“非预期”使用。这些人工智能生成的文章占观点文章发表总量的很大一部分,引发了对新闻业透明度和真实性的质疑。
-
新数据集揭示并旨在减少荷兰语和德语语言模型中的反LGBTQ+偏见
研究人员开发了新的数据集和评估方法,以评估和减轻语言模型中的反LGBTQ+偏见,重点关注荷兰语和德语背景。这些努力解决了除英语之外此类偏见研究不足的问题,创建了包含社区来源刻板印象的文化适应基准。虽然初步评估显示一些模型表现出明显的偏见,特别是针对跨性别者和非二元性别身份,但对多样化内容进行微调可以减少这些问题,尽管并非在所有模型和身份上都能始终如一。
-
科技巨头扫描荷兰书籍用于人工智能训练,引发语言模型担忧
科技巨头公司正以低价收购二手荷兰书籍,用于扫描训练人工智能。这引发了人们对 OpenAI、Google 和 Anthropic 的模型是否会超越荷兰和欧洲语言模型熟练程度的担忧。文章提出了是否需要主动扫描以开发符合荷兰和欧洲标准的AI模型,或者这场语言竞争是否已经输了。
-
AI产品本地化:营收地域比说话者数量更重要
在将AI产品推向全球市场时,仅仅关注语言的说话者数量是错误的。文章认为,市场营收、支付基础设施和购买力比纯粹的说话者数量更为关键。此外,关键人群中的英语熟练程度以及英语在网络内容和训练数据中的普遍性意味着,除了核心几种语言之外,本地化为多种语言的好处正在减少。
-
Unicode CLDR 为语言本地化定义了 1-6 种复数形式
根据 Unicode 联盟的通用区域设置数据存储库 (CLDR) 的定义,一种语言在软件本地化所需的复数形式数量可以从一种到六种不等。这个数量不是语言学的绝对值,而是特定数据集版本的属性。像中文和日文这样的语言只需要一种形式,因为名词不标记复数;而威尔士语和阿拉伯语则需要六种形式,因为它们有复杂的数字交互和语法规则。
-
孟加拉语大语言模型支持滞后是由于数据稀缺,而非需求不足
尽管孟加拉语拥有大量母语使用者,但其在大语言模型中的支持程度却远落后于使用者较少的语言。这种差距并非源于需求不足,而是由于可爬取、机器可读的文本数据稀缺。主要原因之一是历史上使用了自定义字体,将孟加拉语字符映射到ASCII,导致大量旧的数字内容对网络爬虫和语言检测工具不可见。虽然现代孟加拉语出版物使用Unicode,但历史语料库仍包含这些遗留数据,影响了模型训练。
-
AssemblyAI推出Universal-3.5 Pro,扩展多语言转录功能
AssemblyAI发布了其Universal-3.5 Pro模型,增强了其多语言转录能力。该新模型支持18种语言的自动语言检测和原生语码转换,远超其上一代。通过回退到Universal-2来处理不支持语码转换的99种以上语言,该模型提供了更高的准确性和更无缝的体验,可在单次API调用中处理多样化的语言内容。
-
AI代理的提示注入检测器在非英语攻击上失效
对一个开源代理框架的安全审计揭示了其提示注入检测系统存在一个重大漏洞。该扫描器会检查上下文文件、内存写入和工具输出,但在使用英语以外的语言进行提示注入攻击时,未能检测到。虽然像Unicode字符或API密钥泄露这样的技术伪影无论何种语言都能被检测到,但法语、西班牙语、德语和其他语言的书面攻击却被一贯地忽略了。这表明该系统的有效性仅限于英语提示,使得部署容易受到简单的基于翻译的绕过攻击。
-
AI公司为宝藏打捞招聘真正的海盗,年薪高达50万美元
AE Studio是一家AI研究公司,正在招聘一名真正的海盗来领导宝藏打捞行动,年薪高达50万美元。该公司利用AI筛选了8000万页的西班牙殖民时期历史记录,以确定潜在的沉船地点。该职位要求丰富的航海和潜水经验,薪酬包括股权和回收宝藏的份额。
-
Hims 联合创始人驱动的 AI 兽医服务实现每月 20% 的增长
Dutch 是一家由 Joe Spector 联合创立的兽医远程医疗公司,正经历显著增长,其会员数量每月增长 20%。Spector 最近用一个内部团队取代了他的外部营销机构,该团队大量使用 AI 工具生成内容,从而使内容产量增加了十倍,客户获取成本降低了 20%。这一战略转变旨在提高品牌知名度并教育消费者了解虚拟兽医护理的好处。
-
开源ASR模型多样化超越Whisper;比较人类与机器语音识别
一项新的研究论文比较了自动语音识别(ASR)系统和人工听众,发现Google Telephony表现良好,有时甚至在儿童或老年人语音以及弗拉芒语口音等特定语音类型上优于人类。与此同时,开源ASR模型领域正在超越Whisper实现多样化,Cohere的Transcribe和IBM的Granite Speech 4.1已成为强有力的竞争者。然而,这些模型的比较因评估方法不同和私有数据集的影响而变得复杂,这表明对于用户而言,许可、语言支持和…
-
用于健康的AI聊天机器人:益处、风险和自我披露研究
一项涉及1,388名荷兰参与者的研究探讨了将AI聊天机器人用于健康相关咨询。研究发现,感知的益处对用户使用聊天机器人的意愿和披露敏感健康信息的意愿产生了积极影响,而感知的风险则与之呈负相关。与高敏感性话题相比,参与者对低敏感性话题表现出更高的使用意愿,尽管个体特征也在这些感知和意愿中发挥了作用。
-
新模型通过基于图的词汇表模拟早期语言学习
研究人员开发了一个模型,通过将单词学习模拟为基于图的心理词汇表上的搜索过程来理解早期语言习得。与简单的最短路径基线相比,该模型利用激活扩散和类别探索来更好地捕捉词汇发展动态。研究结果表明,激活动态和词汇类别受调控的探索之间的相互作用是理解儿童如何学习不同语言单词的关键。
-
爱尔兰公司注册处备案提供实时尽职调查数据,领先于聚合器
数据聚合延迟可能会使收购尽职调查复杂化,正如最近一次都柏林软件收购事件所表明的那样,在该事件中,付费数据库在官方备案六周后仍显示过时信息。爱尔兰公司注册处(CRO)会快速发布备案信息,但下游数据集可能会滞后,从而产生差异。直接查询CRO数据源,如通过OpenRegistry MCP等工具实现的,可以近乎实时地访问备案顺序,这对于识别公司结构、董事任职或财务安排中可能在静态快照中被忽略的细微变化至关重要。