研究人员开发了StitchCUDA,一个用于端到端GPU程序生成的新型多代理框架。该系统采用专门的代理进行规划、编码和验证,以优化机器学习工作负载。通过将强化学习与性能分析相结合,StitchCUDA旨在提高GPU内核效率和主机端设置,从而在现有基线上实现显著的加速。 AI
影响 该框架通过自动化复杂的编程任务,可以显著加速GPU上复杂ML工作负载的开发和部署。
排序理由 该集群包含一篇详细介绍GPU编程新框架的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
- Cublas
- CUDA
- graphics processing unit
- KernelBench
- National Sun Yat-sen University
- Nicolaus Copernicus University in Toruń
- PyTorch
- StitchCUDA
- Zijian Zhang
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →