PulseAugur
中
实时 11:33:55
实体 Pali

Pali

PulseAugur coverage of Pali — every cluster mentioning Pali across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_254543 ·

    在没有人类审查的情况下评估古典文本中的大型语言模型翻译错误

    研究人员开发了一种新颖的方法,可以在不需要人类参考的情况下评估大型语言模型(LLM)翻译古典文本的准确性。该研究侧重于巴利语到英语的翻译,比较了五个信号:来源新颖性、嵌入距离、同伴翻译分歧、回译和无参考GEMBA评分。由更强的LLM组成的专家小组进行的GEMBA评分被证明是最有效的无参考信号,成功识别了校准集和锚定集中很大一部分的错误。提出的工作流程结合了多个信号,以有效地分配古典语言翻译的人工审查资源。

  2. RESEARCH · CL_199488 ·

    泰语、高棉语、韩语和埃塞俄比亚文字的OCR挑战详述

    像泰语、高棉语、韩语和埃塞俄比亚语这样的文字的光学字符识别(OCR)面临着不同于标准拉丁字母文本的独特挑战。泰语OCR由于词语之间没有空格,在词语分割方面存在困难,需要基于词典的方法。高棉语OCR面临堆叠的辅音下标和可能被标准识别模型丢失或误解的小型变音符号的问题。韩语OCR因历史上混合使用谚文和汉字而变得复杂,在有限的谚文数据集上训练的模型可能会错误地替换汉字。埃塞俄比亚文字是一种音节文字,其字符家族内部存在系统性的混淆,这意味着错…