实体
Cutileiro
Cutileiro
PulseAugur coverage of Cutileiro — every cluster mentioning Cutileiro across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
Tessera系统为AI工作负载解锁异构GPU
一个名为Tessera的新系统已被开发出来,以提高在异构GPU集群上运行大型AI模型的性能和成本效益。与之前在粗粒度级别运行的方法不同,Tessera在内核级别分解工作负载,认识到不同的内核具有不同的资源需求。这种方法可以更精确地将计算与硬件能力对齐,从而在服务吞吐量和成本效益方面取得显著改进。Tessera还展示了对新模型架构的泛化能力,甚至可以在更低的成本下超越同构GPU设置。
-
NVIDIA cuTile教程展示Python GPU内核开发
本教程演示了如何在Google Colab环境中利用NVIDIA cuTile(一个用于编写GPU内核的Python接口)。它引导用户完成必要的Python依赖项设置,并检查cuTile兼容性,包括GPU、CUDA和驱动程序版本。教程提供了向量加法、矩阵加法和矩阵乘法的示例,如果Colab运行时不支持cuTile,则会回退到PyTorch。