PulseAugur
中
实时 02:45:42
实体 HumanEval-X

HumanEval-X

PulseAugur coverage of HumanEval-X — every cluster mentioning HumanEval-X across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_204012 ·

    新方法促进小众编程语言的多语言代码翻译

    研究人员开发了一种改进多语言代码翻译的新方法,特别适用于并行数据稀缺的小众编程语言。他们的方法利用基于执行监督的强化学习来生成和优化翻译候选。该技术使用 Qwen-3.5 4B 和 9B 模型在一个名为 HumanEval-X++ 的新基准上进行了评估,证明了翻译质量的显著提高,尤其是在中等层级的语言方面。

  2. TOOL · CL_53733 ·

    通过反馈指导大型语言模型使用单例设计模式

    一篇新的研究论文探讨了指导大型语言模型(LLMs)将软件设计模式(特别是单例模式)融入生成代码的方法。该研究使用四种提示策略(指令、二进制自动反馈、扩展自动反馈和少样本提示)对13个LLMs在164个Java编码挑战中进行了评估。结果表明,迭代式二进制反馈通常是使LLMs符合单例模式同时保持或提高代码功能的最有效策略。值得注意的是,Llama 3.3在仅使用指令或结合二进制反馈的指导下,实现了100%的单例生成,并通过测试的比例提高了…