PulseAugur
中
实时 09:35:58
实体 Turkish

Turkish

PulseAugur coverage of Turkish — every cluster mentioning Turkish across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
33
90 天内 33
发布 · 30天
0
90 天内 0
论文 · 30天
27
90 天内 27
层级分布 · 90 天
主题
关系
情绪 · 30 天

5 天有情绪数据

最近 · 第 1/2 页 · 共 34 条
  1. TOOL · CL_284569 ·

    TabiBERT:发布新的土耳其语基础模型和基准

    研究人员推出了 TabiBERT,一个基于 ModernBERT 架构的新型大规模土耳其语基础模型。该模型在超过一万亿个 token 的海量数据集上进行了训练,涵盖了网络文本、科学出版物和源代码,并支持 8,192 个 token 的上下文长度。为了评估 TabiBERT,开发了一个名为 TabiBench 的新基准,该基准包含八个任务类别中的 27 个数据集。与之前的土耳其语模型相比,TabiBERT 在问答和代码检索任务上表现出了卓越的性能。

  2. TOOL · CL_279540 ·

    Anthropic 将 Claude 的触角延伸至 Google Workspace 并支持土耳其语

    Anthropic 扩展了其 AI 产品线,带来多项新进展。该公司已为 Google Workspace 发布了一款插件,允许 Claude 在公共测试版中直接编辑 Google Docs、Sheets 和 Slides 中的文档。此外,Anthropic 为 Claude 引入了土耳其语支持,用户可以通过全土耳其语界面与 AI 进行交互。该公司还为 Claude Code 推出了“Mods”,这是一个旨在改变屏幕显示和处理的插件,并…

  3. TOOL · CL_255325 ·

    AI代理Hermes连接agenzax,用母语研究全球供应商

    作者描述了他们将AI代理Hermes连接到一个名为agenzax的新平台的经历,该平台允许代理与现实世界和其他代理进行交互。起初,作者犹豫不决是否让他们的代理执行超出本地任务范围的操作,但当Hermes使用agenzax成功研究了七个国家的全球供应商,并用他们的母语起草询价并收到自动确认后,作者印象深刻。这次实验突显了消除语言障碍以及人工监督在代理交互中的有效性。作者设想agenzax将发展成为一个代理间协作网络,能够在没有直接人工干…

  4. TOOL · CL_254555 ·

    研究发现精神病与言语信息压缩缺陷有关

    一篇发表在arXiv上的新研究探讨了精神病与语言信息压缩之间的联系。研究人员分析了土耳其语使用者的言语,包括那些患有精神分裂症谱系障碍的患者,并发现患者表现出信息压缩能力下降。这种缺陷与语法组织相关,并影响了内在维度和意外度等指标。

  5. TOOL · CL_254524 ·

    LLM在土耳其语语料库研究中难以处理推断性叙事特征

    一项新研究评估了大型语言模型(LLM)和基于规则的系统在土耳其语语料库中标注推断性叙事特征的评分者间信度。研究发现,包括Gemini 2.5 Flash、Grok、Claude Fable-5和ChatGPT 5.5在内的模型,以及一个基于规则的检测器,在诸如具体化隐喻等特征上与人类标注者的一致性较低。研究表明,这些推断性特征可能过于复杂,无法被当前的自动检测系统识别,或者这些定义本身尚未足够操作化,以至于任何评分者都无法一致应用。

  6. TOOL · CL_251577 ·

    开发者创建Kip和Tenioha语言,使用格和助词

    一位开发者创建了一个名为Kip的函数式编程语言,该语言将土耳其语的格融入了其类型系统。受此启发,该开发者随后构建了一个名为Tenioha的类似语言,旨在将日语助词用作参数。整个过程,包括语言、解释器和游乐场,都在一天之内完成。

  7. TOOL · CL_247720 ·

    新方法提高多语言视频转录准确性

    研究人员开发了提高多语言视频语音转录准确性的方法,旨在帮助创建用于跨文化理解的自动化工具。利用公开的YouTube视频和基于Whisper的工具,初步观察到七种语言的平均转录错误率为30%。通过少量微调数据,该错误率降低到20%,使转录结果更适用于下游应用。相关的语音和元数据已发布给社区,以供进一步实验。

  8. RESEARCH · CL_229170 ·

    ChatGPT推荐受查询语言影响,而非地理位置

    一项关于ChatGPT商业推荐的研究发现,查询语言而非退出IP位置,主要决定了是否会推荐本地供应商。该研究跨越多种语言和国家进行,结果显示,首个推荐不稳定,即使输入相同也会发生变化。此外,语言和地理位置是可分离的因素,语言影响品牌名称的市场,而地理位置则影响该市场内推荐的具体产品。

  9. TOOL · CL_223200 ·

    MoganColBERT-TR: 新型土耳其语多向量检索模型发布

    研究人员开发了 MoganColBERT-TR,这是一种专为土耳其语设计的新型多向量检索模型。该模型基于先前训练的 ModernBERT 编码器,并通过蒸馏将其适配到 ColBERT 目标。MoganColBERT-TR 在 token 级别表示查询和文档,并利用晚期交互评分机制。在五个土耳其语 BEIR 数据集上的评估表明其表现强劲,优于更大的模型,并取得了具有竞争力的第二名。

  10. TOOL · CL_221080 ·

    新的土耳其 LLM MoganBert-TR 使用 CLM-to-MLM 课程训练

    研究人员开发了 MoganBert-TR,一个新的土耳其编码器基础模型,以及配套的嵌入模型 MoganBert-Embed。MoganBert-TR 使用新颖的 CLM-to-MLM 课程,在过滤后的土耳其语语料库上从头开始训练,与传统的 MLM 方法相比,在检索任务上表现出显著的改进。该模型在 TrGLUE 和 TabiBench 等基准测试中取得了最先进的成果,而 MoganBert-Embed 在嵌入性能方面表现出色,尽管规模较…

  11. RESEARCH · CL_217961 ·

    新的RAG评估方法在土耳其语和领域特定数据方面出现 · 追踪4个来源

    研究人员正在开发新的方法来评估和改进检索增强生成(RAG)系统。一项研究比较了土耳其语RAG的不同分块和嵌入策略,发现对于包含表格的文档,布局感知分块最有效,而特定语言的嵌入模型并未提供显著优势。另一篇论文介绍了一个统一的贝叶斯框架,称为The RAT,用于联合建模检索成功率、弃权和答案正确性,揭示了在边际指标上看似相似的RAG系统之间的行为差异。第三种方法TRIAD自动化了用于RAG评估的领域特定问答数据集的生成,包括多跳查询和无法…

  12. RESEARCH · CL_217984 ·

    新的土耳其多模态语料库旨在改进对话式AI的轮次转换

    研究人员推出了Real-TurnTurk,这是一个新的多模态土耳其语对话数据集,旨在改进同步对话系统中轮次转换的预测。该数据集包含未脚本化的二元互动同步视频、音频和转录文本。为了预测轮次转换,该研究采用遗传算法,基于视觉、声学和语言特征优化可解释的决策规则,并利用混合AND-OR规则表示。

  13. COMMENTARY · CL_202167 ·

    提示词工程:原生撰写类似输出的文本,指令可翻译

    一种新的提示词工程方法提出,只有提示词中与期望输出相似的部分应使用目标语言原生撰写,而指令和辅助性内容则可以使用模型最理解的语言。该方法源于语言模型主要模仿其续写文本风格的理解。翻译后的提示词常引入“翻译腔”,包括省略主语代词、生硬的复合词、不恰当的礼貌用语以及不自然的语调,导致输出听起来像翻译过来的。通过将类似输出的文本与指令性文本分开,可以优化提示词,以获得更好的模型性能和更自然的输出结果。

  14. TOOL · CL_198143 ·

    新方法从广播新闻中学习手语表示

    研究人员开发了一种从广播新闻字幕中学习手语表示的方法,由于口语和手语之间的对齐松散,这些字幕提供了弱监督。这种方法对于土耳其语等资源受限的语言尤其有益,因为密集的语言标签成本高昂。通过结合基于规则和LLM辅助的规范化,他们在TSL-News语料库上预训练了一个可重用的手语编码器。该编码器显著提高了跨数据集手语识别的性能,将时间定位的平均IoU从0.235提高到0.465,并增强了下游翻译任务。

  15. TOOL · CL_195921 ·

    GFlowNets 被用于生成新的英文和土耳其文 LLM 攻击

    研究人员开发了一种使用 GFlowNets 自动生成针对大型语言模型 (LLM) 的对抗性攻击的新方法。该方法训练一个攻击者模型来识别受害者 LLM 中的漏洞,并提供量化的鲁棒性分数。该系统旨在适应性强且独立于人类,目标是产生比当前基准更有效的攻击。值得注意的是,这项研究引入了除英语外,还能生成土耳其语攻击输入的能力。

  16. SIGNIFICANT · CL_195455 ·

    AssemblyAI推出Universal-3.5 Pro,扩展多语言转录功能

    AssemblyAI发布了其Universal-3.5 Pro模型,增强了其多语言转录能力。该新模型支持18种语言的自动语言检测和原生语码转换,远超其上一代。通过回退到Universal-2来处理不支持语码转换的99种以上语言,该模型提供了更高的准确性和更无缝的体验,可在单次API调用中处理多样化的语言内容。

  17. TOOL · CL_188134 ·

    AI代理的提示注入检测器在非英语攻击上失效

    对一个开源代理框架的安全审计揭示了其提示注入检测系统存在一个重大漏洞。该扫描器会检查上下文文件、内存写入和工具输出,但在使用英语以外的语言进行提示注入攻击时,未能检测到。虽然像Unicode字符或API密钥泄露这样的技术伪影无论何种语言都能被检测到,但法语、西班牙语、德语和其他语言的书面攻击却被一贯地忽略了。这表明该系统的有效性仅限于英语提示,使得部署容易受到简单的基于翻译的绕过攻击。

  18. TOOL · CL_183299 ·

    HukukBERT:土耳其法律文本新语言模型

    研究人员开发了HukukBERT,一个专门用于处理土耳其法律文本的语言模型。该模型使用混合预训练方法,结合了各种掩码技术,在大量的土耳其法律文件语料库上进行了训练。HukukBERT在法律文本分析基准测试中表现出色,包括预测掩码法律术语和分割判决书,其性能优于现有的土耳其语语言模型。

  19. TOOL · CL_178338 ·

    突厥语族的跨语言迁移在特定语对上表现出强劲性能

    研究人员调查了突厥语族内部机器翻译的跨语言迁移技术,重点关注土耳其语、阿塞拜疆语、乌兹别克语、哈萨克语和吉尔吉斯语。他们的发现表明,迁移在密切相关的语对之间最为有效,例如土耳其语和阿塞拜疆语,或哈萨克语和吉尔吉斯语。研究还强调,迁移方向会影响性能,并且在某些情况下,使用拉丁字母可以提高BLEU和chrF等翻译指标,但并非在所有指标上都普遍适用。

  20. TOOL · CL_145672 ·

    研究论文指出LLM-作为-裁判合成语料库存在结构性缺陷

    一篇新的研究论文强调了在创建用于评估大型语言模型(LLM)作为裁判的合成数据集时存在的一个关键问题。研究表明,为这些数据集生成“幻觉”答案的过程可能会悄无声息地失败,导致结果失真或不准确。这种在多语言语料库中观察到的故障模式导致了裁判准确率的显著下降,并改变了其他测量偏差的大小,而这些偏差无法通过标准的统计检查来检测。该论文为LLM生成的语料库引入了“测试预言机问题”,并提出与那些仅依赖LLM生成的负面示例的语料库不同,通过对正确答案…