PulseAugur
实时 22:40:35

Hugging Face 发布 MTEB 基准测试,用于评估波兰语文本嵌入

研究人员推出了波兰语大规模文本嵌入基准测试(PL-MTEB),这是一个专为评估波兰语文本嵌入模型而设计的新评估套件。该基准测试包含跨越五个类别(如分类、聚类和信息检索)的 30 个多样化 NLP 任务。该研究评估了 30 个公开可用的文本嵌入模型,分析了它们在不同任务类型和规模下的表现,所有数据集和代码均公开可用。 AI

排序理由 这是一篇介绍用于评估特定语言文本嵌入模型新基准测试的研究论文。

在 Hugging Face Blog 阅读 →

AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →

Hugging Face 发布 MTEB 基准测试,用于评估波兰语文本嵌入

报道来源 [2]

  1. Hugging Face Blog TIER_1 English(EN) ·

    MTEB:大规模文本嵌入基准测试

  2. arXiv cs.CL TIER_1 English(EN) · Rafa{\l} Po\'swiata, S{\l}awomir Dadas, Micha{\l} Pere{\l}kiewicz ·

    PL-MTEB: 波兰大规模文本嵌入基准测试

    arXiv:2405.10138v2 Announce Type: replace Abstract: In this paper, we introduce the Polish Massive Text Embedding Benchmark (PL-MTEB), a comprehensive benchmark for text embeddings in the Polish language. PL-MTEB comprises 30 diverse NLP tasks across five categories: classificati…