PulseAugur
实时 10:21:21
English(EN) Efficient Code Embeddings from Code Generation Models

新的jina-code-embeddings模型达到SOTA性能

一套新的代码嵌入模型jina-code-embeddings已被开发出来,用于通过自然语言查询进行代码检索、技术问答以及识别跨编程语言的相似代码片段。这些模型利用在文本和代码上训练的自回归骨干网络,通过最后一个token池化生成嵌入。尽管模型相对较小,但它们展示了最先进的性能,验证了构建有效代码嵌入模型的方法。 AI

影响 这项研究引入了一种新的代码嵌入方法,可以改善开发者的代码搜索和理解能力。

排序理由 这是一篇详细介绍新模型套件的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.AI 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

新的jina-code-embeddings模型达到SOTA性能

报道来源 [1]

  1. arXiv cs.AI TIER_1 English(EN) · Daria Kryvosheieva, Saba Sturua, Michael G\"unther, Han Xiao ·

    高效代码生成模型的代码嵌入

    arXiv:2508.21290v2 Announce Type: replace-cross Abstract: jina-code-embeddings is a novel code embedding model suite designed to retrieve code from natural language queries, perform technical question-answering, and identify semantically similar code snippets across programming l…