PulseAugur
实时 05:48:02
实体 Manuel Israel Cazares

Manuel Israel Cazares

PulseAugur coverage of Manuel Israel Cazares — every cluster mentioning Manuel Israel Cazares across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. RESEARCH · CL_147787 ·

    LLM路由假设在代码安全漏洞检测中得到证实

    一篇新的研究论文探讨了大语言模型(LLM)中的“路由假设”,认为模型拥有知识但难以在内部路由以激活它。该研究在代码安全漏洞检测中重现了先前在数学推理任务中的发现,使用了GPT-OSS-120B、Llama-3.3-70B和Gemma-4-31B等模型。结果表明,结构化先验(备忘单)在合成数据上显著提高了性能,但在应用于真实CVE数据时导致准确率大幅下降,表明存在跨领域权衡。

  2. RESEARCH · CL_128518 ·

    研究发现:LLM 在经过验证的数学结构上出现路由失败

    一项新研究调查了大型语言模型(LLM)在处理经过形式验证的代数结构时出现的路由失败问题。研究发现,在盲测条件下,GPT-OSS 120B 的模板准确率为 80.3%,Llama 3.3-70B 的准确率为 68.2%。提供“Lean verdict/witness cue”显著提高了两个模型的准确率,GPT-OSS 120B 达到 90.9%,Llama 3.3-70B 达到 81.8%。研究确定了 CRT 和环等价之间的常见错误路由…