实体
ggml-cuda
ggml-cuda
PulseAugur coverage of ggml-cuda — every cluster mentioning ggml-cuda across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天
2 天有情绪数据
最近 · 第 1/1 页 · 共 3 条
-
llama.cpp 为 AMD RDNA2 性能带来改进 · 跟踪 1 个来源
一项针对 llama.cpp 项目的拉取请求,特别是针对 ggml-cuda,为 AMD 的 RDNA2 架构(包括 MI50 和 MI60 GPU)带来了性能改进。这些增强功能在基准测试中有详细说明,并在拉取请求的评论中进行了讨论,旨在优化特定 AMD 硬件的处理能力。
-
llama.cpp 发布更新,修复性能和稳定性问题 · 跟踪 9 个来源
llama.cpp 项目发布了多个更新,包括 0.4.1 版本,该版本解决了跨不同平台的各种性能和稳定性问题。值得注意的更改包括对 SYCL 后端的优化、CPU 堆损坏的修复以及对缺乏 BF16 硬件加速的 CUDA 设备的后备机制。这些更新旨在提高在各种硬件上运行语言模型的效率和可靠性。
-
llama.cpp 发布多个更新,包含性能和错误修复
llama.cpp 项目已发布多个更新,包括 b9975、b9974、b9973、b9972、b9971、b9970、b9969、b9968、b9966 和 b9965 版本。这些发布在 macOS、Linux、Android 和 Windows 等多个平台上引入了各种改进和错误修复。值得注意的更改包括对 DeepSeek 模型的优化、在 Adreno GPU 等特定硬件上 Vulkan 和 OpenCL 性能的增强,以及对 CUDA…