Perplexity 已开源 Lily,这是一款使用 Rust 和 Metal 构建的专用推理引擎,用于在 Apple Silicon 上运行 Qwen3.6-35B-A3B 模型。该引擎通过紧密集成模型结构、执行计划和内核选择,绕过 PyTorch 和 MLX 等传统框架,旨在实现高性能。与现有实现相比,Lily 在预填充和解码操作方面均实现了显著的加速,尤其是在具有大量统一内存的 Mac 上处理长上下文时。 AI
影响 使得在 Apple 硬件上进行更高效的本地 LLM 推理成为可能,有望改善 Perplexity 产品用户体验。
排序理由 针对特定模型和硬件的专用推理引擎的开源。
- Apple Silicon
- Lily
- macOS
- Metal
- Mlx
- mlx-lm
- OpenAI
- Perplexity
- Perplexity Computer
- PyTorch
- Qwen3.6-35B-A3B
- Rust
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →