PulseAugur
实时 08:44:42
实体 KernelBench-Mega

KernelBench-Mega

PulseAugur coverage of KernelBench-Mega — every cluster mentioning KernelBench-Mega across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 3 条
  1. SIGNIFICANT · CL_128179 ·

    Fable 5 登顶 KernelBench-Mega,性能超越 Claude Opus 和 GPT 5.5

    Fable 5 在 KernelBench-Mega 基准测试中位居榜首,展示了 AI 在研发任务方面能力的显著提升。该 AI 模型生成的 Cuda 代码在 RTX PRO 6000 Blackwell 上比优化的 PyTorch 基线实现了 18.71 倍的速度提升。在此基准测试中,其性能超越了 Claude Opus 4.8、GLM-5.2 和 GPT 5.5 等其他领先模型。Fable 的方法因其每个 token 发起一次协同内…

  2. RESEARCH · CL_127537 ·

    AI 模型 Fable 编写更快的 GPU 内核并自动化在线工作 · 跟踪 2 个来源

    一款名为 Fable 的新 AI 模型已展示出编写高效 GPU 内核的能力,在 Nvidia RTX Pro 6000 Blackwell Workstation Edition 上实现了比优化后的 PyTorch 基线快 18.71 倍的速度。在 KernelBench-Mega 基准测试中,此性能超越了 Claude-Opus-4.8、GLM-5.2 和 GPT-5.5 等其他领先模型,表明 AI 在研发自动化方面取得了进展。此外…

  3. TOOL · CL_101579 ·

    Claude Opus 4.8 在 KernelBench-Mega 基准测试中领先,性能超越 NVIDIA GPU

    一项名为 KernelBench-Mega 的新基准测试已发布,该测试涉及为每个生成的 token 重写 GPU megakernels。该基准测试在 NVIDIA 的 RTX PRO 6000、H100 和 B200 GPU 上进行了测试,Claude Opus 4.8 表现出卓越的性能,在 B200 上相比参考模型速度提升高达 19.4 倍。GLM-5.2 在此次评估中成为性能最佳的开源模型。