实体
Semantic Textual Similarity Methods, Tools, and Applications: A Survey
Semantic Textual Similarity Methods, Tools, and Applications: A Survey
PulseAugur coverage of Semantic Textual Similarity Methods, Tools, and Applications: A Survey — every cluster mentioning Semantic Textual Similarity Methods, Tools, and Applications: A Survey across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
LLM 与嵌入模型:新研究发现代价高昂的均等性
一篇题为《嵌入器的困境》的新论文比较了大型语言模型(LLM)与专用嵌入模型在各种任务上的性能和成本。研究发现,虽然像 Gemini 3.1 Pro 这样的 LLM 在平均表现上与顶级嵌入模型相当,但它们的成本却高得多,速度也慢得多。LLM 在推理密集型检索任务上表现出色,而嵌入模型更适合分类任务,两种范式在聚类和语义文本相似性方面的表现相似。
-
新的基准测试评估葡萄牙语文本嵌入模型,揭示性能差距
发布了两个新的基准测试 MTEB-PT 和 MTEB-PT(巴西葡萄牙语),专门用于评估葡萄牙语的文本嵌入模型。这些基准测试解决了现有评估中葡萄牙语代表性不足的问题,而现有评估通常依赖于翻译的数据集或多语言平均值。新的基准测试包含大量葡萄牙语原生任务,涵盖语义文本相似性、分类、检索和重新排序等多个类别。初步评估表明,模型性能高度依赖于任务,并且在多语言基准测试上的排名并不能可靠地预测葡萄牙语特定性能,这凸显了进行原生语言评估的必要性。