PulseAugur
实时 08:16:05
实体 European Portuguese

European Portuguese

PulseAugur coverage of European Portuguese — every cluster mentioning European Portuguese across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 7
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 6
层级分布 · 90 天
主题
情绪 · 30 天

2 天有情绪数据

最近 · 第 1/1 页 · 共 7 条
  1. RESEARCH · CL_135127 ·

    研究质疑AMALIA LLM作为数据标注员的有效性

    一篇新发表在arXiv上的研究评估了大型语言模型(LLM)作为数据标注员的有效性,重点关注葡萄牙的国家模型AMALIA。AMALIA是一个拥有90亿参数、针对欧洲葡萄牙语的模型,在编码道德基础方面与人类编码员的达成度具有竞争力。然而,研究表明它可能依赖于表面相关性而非理论建构。当提示被分解时,AMALIA的表现显著下降,表明它并未完全理解潜在的理论。研究得出结论,虽然AMALIA可以协助大规模预编码,但它尚未达到独立标注复杂建构的可靠…

  2. TOOL · CL_131528 ·

    Persona塑造LLM Agent在策略游戏中的行为

    研究人员调查了Persona提示如何影响大型语言模型Agent在“分还是偷”游戏中的策略行为。他们使用了四种开源模型(Ministral-3-3B、phi4:14b、Gemma3:12b和Gemma4:e4b)与一个由GPT-4.1 mini驱动的虚拟人类进行交互,发现相互“分”的结果占主导地位,约占回合数的74%。模型选择显著影响了Agent的行为,phi4和Ministral-3-3B始终表现出合作性,而Gemma模型则展现出更多…

  3. TOOL · CL_97627 ·

    AMALIA-VL:发布新的欧洲葡萄牙语开源视觉语言模型

    研究人员推出了 AMALIA-VL,一个专为欧洲葡萄牙语设计的新型开源视觉与语言模型。现有模型常常忽略或错误表示该语言变体。AMALIA-VL 采用高分辨率视觉编码器和为欧洲葡萄牙语优化的语言模型,通过三阶段训练过程开发。该项目旨在通过发布模型权重、训练数据和评估基准,来普及欧洲葡萄牙语大型视觉语言模型的发展。

  4. TOOL · CL_97629 ·

    New benchmark PorTEXTO targets European Portuguese visual text extraction

    研究人员推出 PorTEXTO,这是一个旨在改进欧洲葡萄牙语 (pt-PT) 视觉文本提取的新基准。该基准解决了现有光学字符识别 (OCR) 基准中 pt-PT 资源稀缺的问题,这些基准通常侧重于资源丰富的语言或历史文本。PorTEXTO 使用了一个管道,该管道结合了大型语言模型的转录和母语人士的人工审查,以确保其质量和与当代应用的相关性。研究发现,专门的多语言数据比模型大小或分辨率更能有效提高 pt-PT OCR 的性能,这凸显了对…

  5. RESEARCH · CL_93392 ·

    新基准揭示大型语言模型对巴西葡萄牙语存在偏见

    一个名为 P3B3 的新基准已被开发出来,用于评估大型语言模型(LLMs)如何处理葡萄牙语的变体,特别是欧洲葡萄牙语(pt-PT)和巴西葡萄牙语(pt-BR)。该基准旨在解决当前 pt-BR 数据更普遍存在的不平衡问题,导致大型语言模型(LLMs)表现出对该变体的偏见。使用 P3B3 进行的实验显示,大多数经过测试的大型语言模型(LLMs)都强烈偏好 pt-BR,不同模型之间的可控性程度各不相同,这突显了在大型语言模型(LLMs)中更…

  6. RESEARCH · CL_53583 ·

    FalAR语料库以5800小时议会数据助力欧洲葡萄牙语ASR

    研究人员推出FalAR,一个用于欧洲葡萄牙语议会话语的新型大规模语音语料库,旨在改进该语言的自动语音识别(ASR)。该语料库包含约5800小时的语音数据,跨越20年,并为1180名个人提供了说话人身份标注。实验表明,使用FalAR进行预训练可以显著提高ASR性能,将词错误率(WER)降低高达14%。

  7. RESEARCH · CL_26784 ·

    Amália LLM 旨在服务欧洲葡萄牙语使用者

    一款名为 Amália 的新大型语言模型正在开发中,旨在专门服务欧洲葡萄牙语使用者。该举措旨在弥合目前缺乏针对该语言变体细微差别量身定制的高质量人工智能模型的差距。该项目凸显了为不同语言社区创建专业化大语言模型的日益增长的趋势。