最新发布的 llama.cpp 版本 b10336,对 WebGPU 着色语言 (WGSL) 文件进行了重大重构,并简化了 flash_attn WGSL 的实现。此次更新侧重于提高 WebGPU 加速的代码效率和结构,特别是针对 macOS 上的 Apple Silicon 硬件。 AI
影响 通过优化的 WebGPU 着色器,提升了 Apple Silicon 硬件上 AI 工作负载的性能。
排序理由 这是对一个开源项目的软件更新,而非来自主要 AI 实验室的前沿发布。
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →