PulseAugur
实时 09:58:48
实体 Yoruba

Yoruba

PulseAugur coverage of Yoruba — every cluster mentioning Yoruba across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
5
90 天内 13
发布 · 30天
0
90 天内 0
论文 · 30天
4
90 天内 9
层级分布 · 90 天
主题
关系
情绪 · 30 天

4 天有情绪数据

最近 · 第 1/1 页 · 共 13 条
  1. TOOL · CL_215666 ·

    First City Monument Bank 将为农民提供本地语言的 AI 咨询服务

    First City Monument Bank 正在整合 AI,以豪萨语、约鲁巴语和伊博语提供咨询服务。该计划旨在支持小农户。该银行的努力在其 Agritech 校友影响报告中有详细介绍,该报告涵盖 2018 年至 2026 年。

  2. TOOL · CL_210410 ·

    新方法在无需重新训练的情况下恢复了非洲语言的AI安全性

    研究人员开发了一种名为潜在空间拒绝锚定(Latent Space Refusal Anchoring, LSR-Anchoring)的新型无需训练的方法,以提高低资源非洲语言指令调优AI模型的安全性。该技术旨在恢复模型在英语中通常存在但在约鲁巴语、伊博语、伊加拉语和豪萨语等语言中缺失的拒绝能力,而无需进行大量重新训练或新的标记数据。主要变体“平均激活引导”(Mean-Activation Steering, MAS)在某些架构上显示出…

  3. TOOL · CL_191306 ·

    新的AfriNLLB模型为15种非洲语言提供高效翻译

    研究人员开发了AfriNLLB,这是一套专为非洲语言设计的轻量级翻译模型。这些模型源自NLLB-200 600M架构,通过层剪枝和量化进行压缩。AfriNLLB模型在精心策划的非洲语言平行语料库上进行了微调,旨在为资源受限的环境提供高效的翻译能力。评估表明,AfriNLLB模型在实现与基线模型相当的性能的同时,翻译速度显著提高。

  4. RESEARCH · CL_193712 ·

    分词溢价为非英语语言制造人工智能成本障碍 · arXiv cs.CL

    一项发表在arXiv上的新研究介绍了分词公平性审计(TEA),这是一个旨在衡量大型语言模型对不同语言分词差异的基准。研究发现,与英语相比,孟加拉语、印地语和约鲁巴语等语言的语义等效内容可能需要更多的分词,这会影响API成本、延迟和有效上下文窗口长度。这种分词溢价因模型和分词器而异,凸显了依赖人工智能工具的服务欠缺语言社区可能面临的经济和功能障碍。

  5. RESEARCH · CL_174085 ·

    新论文探讨AI对世界英语语言多样性的影响 · 已追踪3个来源

    三篇最新的学术论文探讨了生成式AI与语言多样性之间的复杂关系,特别关注世界英语。第一篇论文讨论了AI工具如何能够既促进学术写作的民主化,又可能边缘化少数英语变体,呼吁制定具有公平意识的政策和包容性的协同设计。第二篇论文考察了大型语言模型(LLMs)如何再生产占主导地位的语言意识形态,偏袒“内圈”规范,并可能对“外圈”英语用户构成挑战,同时也指出一个悖论:AI可能使英语趋于同质化,但又通过多样化的语料库使其多样化。第三篇论文评估了AI在…

  6. TOOL · CL_156457 ·

    为约鲁巴语开发了新的语音合成器

    研究人员开发了TTSYoruba,一个基于规则的约鲁巴语语音合成器。该系统利用手工制作的音韵规则系统和记录的双音单元库,将带音标的约鲁巴语文本转换为音频。该系统解决了鼻音消歧和轮廓音推导等挑战,并整合了新的音标标记正字法约定。通过一项包含50名参与者的听者研究对其性能进行了评估。

  7. TOOL · CL_151394 ·

    开发者构建带记忆系统的AI,使用专门的Qwen模型

    一位开发者创建了一个名为Àtúnbí(约鲁巴语意为“重生”)的新型AI记忆系统,旨在克服无状态AI对话的局限性。该系统根据信息的重要性和情感权重进行优先排序,延长有价值数据的生命周期,并将关键见解整合为永久性摘要和结构化事实。该架构包含五个不同的记忆层级,包括工作记忆、情景记忆、语义记忆、实体记忆和程序记忆,其中语义记忆保留了被取代信息的审计追踪。该系统利用一个路由器来管理七个专门的Qwen模型,每个模型被分配从音频转录到深度摘要等特…

  8. TOOL · CL_121327 ·

    OmniVoice 微调以实现约鲁巴语零样本语音克隆

    一位开发者对 OmniVoice 文本到语音模型进行了约鲁巴语的微调,约鲁巴语是一种声调语言,精确的发音对意义至关重要。该过程包括通过合并高质量的录音室录音和多样化的众包语音来构建数据集,总计约 156 位发言者的 9.6 小时数据。一个关键发现是,约鲁巴语中的变音符号不仅仅是格式,它们携带了重要的声调信息,并且保留它们对于准确和清晰的语音合成至关重要。

  9. MEME · CL_81263 ·

    Mastodon 上推广的 NSFW 动漫插画

    此集群包含两条 Mastodon 帖子,其中展示了 Rikka Takarada 和 Yor 的动漫风格插画。这些帖子包含与 NSFW 内容、hentai 和 AI 生成图像相关的标签。它们还推广了一个提供独家内容的 Patreon 页面。

  10. RESEARCH · CL_68194 ·

    研究发现对比提示可提升非洲语言NLI性能

    一项新近发表在arXiv上的研究,探讨了低资源非洲语言(特别是斯瓦希里语、约鲁巴语和豪萨语)的自然语言推断(NLI)的提示策略。研究人员在Llama3.2-3B和Gemma3-4B模型上评估了五种不同的提示技术,发现对比提示始终能获得最佳结果。研究强调了提示构建在实现这些语言稳健的NLI性能方面起着至关重要的作用,甚至优于具有少样本示例或思维链推理的模型。

  11. RESEARCH · CL_58847 ·

    新语料库旨在促进非洲语言在科学领域的应用

    一个名为 AfriScience-MT 的新平行语料库已被开发出来,以解决六种非洲语言(阿姆哈拉语、豪萨语、卢干达语、北部索托语、约鲁巴语和祖鲁语)在科学术语方面存在的不足。该语料库由专业翻译和科学传播者创建,涵盖 11 个科学领域,旨在实现非洲科学传播的去殖民化。对机器翻译系统和大型语言模型的基准测试显示,GPT-5.4 和 Gemini-3.1-Flash-Lite 等闭源模型优于开源模型,其中 NLLB-1.3B 在微调后表现最佳。

  12. TOOL · CL_38321 ·

    新的 SBPN 模型通过知识蒸馏提升尼日利亚语言 ASR 性能

    研究人员开发了一个名为 Sometin Beta Pass Notin (SBPN) 的新多语言自动语音识别 (ASR) 框架,以提高尼日利亚语言的性能。该框架采用两阶段知识蒸馏过程,首先从单一语言模型进行蒸馏,然后通过伪标记数据的迭代自我改进。该方法在 Common Voice 和 Fleurs 等基准测试中,相对于基线平均降低了 29% 的词错误率,并且优于现有的最先进的多语言模型。SBPN 以两种尺寸发布为开放基础模型,旨在为该…

  13. RESEARCH · CL_06731 ·

    CURE-Med框架增强了大型语言模型的多语言医疗推理能力

    研究人员开发了CURE-Med,一个利用课程学习强化学习来增强大型语言模型多语言医疗推理能力的新框架。该方法集成了代码切换感知监督微调和组相对策略优化,以提高逻辑准确性和语言一致性。该框架已在包括代表性不足的语言在内的十三种语言上进行了测试,显示出显著的性能提升,即使是参数较小的模型也能实现高语言一致性和逻辑正确性。