PulseAugur
实时 08:39:05
实体 mlx-lm

mlx-lm

PulseAugur coverage of mlx-lm — every cluster mentioning mlx-lm across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_167685 ·

    FusionML 通过 CPU-GPU 协同执行提升 Apple Silicon 的 AI 推理性能

    研究人员开发了 FusionML 系统,通过协同执行 CPU 和 GPU 操作来优化 Apple Silicon 上的 Transformer 推理。通过解决 MLX 调度器导致的串行化限制,FusionML 实现了 Transformer 预填充的行切分方法,使 Llama 模型提速 1.15 倍至 1.38 倍,Qwen2.5-7B 的首次 token 时间缩短 1.18 倍至 1.25 倍。该系统在多代 Apple Silico…

  2. RESEARCH · CL_70649 ·

    Gemma 4 12B 本地 AI 模型需要配置调整以获得最佳性能

    Google 的 Gemma 4 12B 模型在本地 AI 设置方面显示出潜力,但用户报告称 LM Studio 等工具中的默认配置会阻碍其推理能力。需要对 Jinja 模板和采样参数进行特定调整,例如提高 temperature 和禁用 token mismatch,才能充分发挥其潜力。虽然 Gemma 4 12B 已证明能够正确重写代码并替换低效循环,但其性能受限于模型大小,像 Qwen 35B 这样更大的模型在基准测试中发现了更多 bug。