实体
ParallelKernelBench
ParallelKernelBench
PulseAugur coverage of ParallelKernelBench — every cluster mentioning ParallelKernelBench across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
Together AI 发布 ParallelKernelBench 以测试 LLM 多 GPU 内核生成
Together AI 推出了 ParallelKernelBench,这是一个开源基准测试,旨在评估大型语言模型为多 GPU 系统生成高效 CUDA 内核的能力。该基准测试侧重于评估前沿 LLM 在处理复杂、通信密集型工作负载方面的能力,这对于高性能计算至关重要。此次发布凸显了在优化 LLM 以适应专业化、低级编程任务方面持续存在的挑战。
-
前沿大语言模型在多GPU内核生成方面遇到困难,新基准测试揭示
一项名为ParallelKernelBench (PKB) 的新基准测试已被开发出来,用于评估前沿大语言模型生成高效多GPU内核的能力。对GPT-5.5、Gemini 3 Pro和Opus 4.7等模型的测试显示出显著的性能差距,只有不到三分之一的问题得到正确解决,而其中只有不到四分之一的性能优于简单的基线。该基准测试侧重于用NVLink上的直接CUDA内核替换PyTorch + NCCL,解决了经常成为AI推理瓶颈的关键通信开销。