PulseAugur
实时 06:43:13
实体 CyberSecEval Malware Analysis benchmark

CyberSecEval Malware Analysis benchmark

PulseAugur coverage of CyberSecEval Malware Analysis benchmark — every cluster mentioning CyberSecEval Malware Analysis benchmark across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_158606 ·

    小型语言模型集成在恶意软件分析中超越单一大型语言模型

    研究人员已证明,在恶意软件分析中,编排多个小型语言模型(SLM)可以有效地媲美甚至超越单一、大型语言模型(LLM)的性能。通过采用多智能体管道、对抗性辩论和分层咨询等各种架构,SLM集成显示出显著的改进。一个结合了Qwen3-4B和Foundation-Sec-8B的混合系统在Meta的CyberSecEval恶意软件分析基准测试中达到了35.30%的准确率,优于专业基线模型和未接地的前沿模型,尽管一个接地的Gemini配置仍以38.…