PulseAugur
中
实时 05:11:29
实体 GGML_HEXAGON_FA_HEAD_SPLIT

GGML_HEXAGON_FA_HEAD_SPLIT

PulseAugur coverage of GGML_HEXAGON_FA_HEAD_SPLIT — every cluster mentioning GGML_HEXAGON_FA_HEAD_SPLIT across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_281704 ·

    llama.cpp 优化 hexagon 架构以加速 AI 模型推理

    llama.cpp 项目发布了更新 b11430,专注于 hexagon 架构的性能改进。此次更新为 flash-attention 引入了头并行分区,允许每个核心处理 KV 缓存的特定头分片。这一改变显著提升了 Qwen3-0.6B 和 Llama 3.2:3b 等特定模型的性能,分别测量到高达 58% 和 49% 的提升。更新还包括了受 GGML_HEXAGON_FA_HEAD_SPLIT 标志控制的矩阵乘法和多设备场景的各种优化。