PulseAugur
中
实时 14:59:57
实体 Automated Tensor Scheduling for Hybrid CPU-GPU LLM Inference on Consumer Devices

Automated Tensor Scheduling for Hybrid CPU-GPU LLM Inference on Consumer Devices

PulseAugur coverage of Automated Tensor Scheduling for Hybrid CPU-GPU LLM Inference on Consumer Devices — every cluster mentioning Automated Tensor Scheduling for Hybrid CPU-GPU LLM Inference on Consumer Devices across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 1 条
  1. RESEARCH · CL_147894 ·

    LLM 推动 GPU 内核生成和推理优化 · 跟踪 4 个来源

    研究人员正在开发利用大型语言模型 (LLM) 优化 GPU 内核生成的先进方法。其中一种方法在 MLSys 2026 上提出,使用以工程化为中心(harness-centered)的系统来约束、验证和分析 LLM 生成的代码,与基线实现相比实现了显著的加速。另一项研究引入了 Atrex-Bench,这是一个源自生产推理跟踪的基准测试,用于评估 LLM 生成的 GPU 内核,结果显示当前模型仅能达到硬件潜力的约 10%,并且经常依赖回退…