研究人员开发了 CHORUS,一个用于生成高覆盖率硬件验证测试激励的新型训练后框架。通过利用分阶段 SFT 检查点和密集奖励 RL 的互补优势,CHORUS 将多个专家整合到一个 4B 模型中。该方法显著优于现有方法,在 CVDP-ECov 基准测试上实现了 88.0% 的 Pass@1,比规模大得多的 671B DeepSeek-R1 模型提高了 13.5 个百分点。 AI
排序理由 该集群描述了一篇关于硬件验证激励生成新颖框架的最新研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →