PulseAugur
实时 13:31:06
实体 ggml-webgpu

ggml-webgpu

PulseAugur coverage of ggml-webgpu — every cluster mentioning ggml-webgpu across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_191826 ·

    llama.cpp b10336 为 Apple Silicon 重构 WebGPU 着色器

    最新发布的 llama.cpp 版本 b10336,对 WebGPU 着色语言 (WGSL) 文件进行了重大重构,并简化了 flash_attn WGSL 的实现。此次更新侧重于提高 WebGPU 加速的代码效率和结构,特别是针对 macOS 上的 Apple Silicon 硬件。

  2. TOOL · CL_79340 ·

    llama.cpp PR 将 k-quant 模型速度提升高达 3.78 倍

    llama.cpp 项目的一个拉取请求(pull request)为 k-quantized 模型引入了优化,显著提高了预填充速度。这些更改侧重于各种量化级别(包括 Q4、Q5 和 Q8)的矩阵乘法(matmul)操作。在 M2 Pro 芯片上的基准测试显示,某些量化的速度提升高达 3.78 倍,从而提高了本地大型语言模型的性能。