PulseAugur
中
实时 21:48:39
实体 ggml-cpu

ggml-cpu

PulseAugur coverage of ggml-cpu — every cluster mentioning ggml-cpu across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
3
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 3 条
  1. TOOL · CL_236624 ·

    llama.cpp 发布更新,修复性能和稳定性问题 · 跟踪 9 个来源

    llama.cpp 项目发布了多个更新,包括 0.4.1 版本,该版本解决了跨不同平台的各种性能和稳定性问题。值得注意的更改包括对 SYCL 后端的优化、CPU 堆损坏的修复以及对缺乏 BF16 硬件加速的 CUDA 设备的后备机制。这些更新旨在提高在各种硬件上运行语言模型的效率和可靠性。

  2. TOOL · CL_211784 ·

    llama.cpp 发布 b10520 版本,包含 ggml-cpu 更新

    llama.cpp 项目发布了 b10520 版本,其中包括对其 ggml-cpu 组件的更新。这些更改侧重于基于 __ARM_FP16_FORMAT_IEEE 来控制 __fp16,并确保正确处理 __ARM_NEON 信号。

  3. TOOL · CL_127771 ·

    llama.cpp 通过 UE4M3 LUT 为 ARM 添加 NVFP4 点积优化

    llama.cpp 项目的一个拉取请求通过将 UE4M3 查找表 (LUT) 扩展到 NVFP4 点积实现,为 ARM 处理器引入了一项优化。此更改使 ARM 版本与现有的 x86 优化保持一致,并利用了共享的 LUT 基础设施。基准测试显示性能显著提升,在一个使用 4 个线程的 Qwen3.5-4B-NVFP4 模型上的测试用例中,速度从每秒 1.89 个 token 提高到每秒 9.97 个 token。