研究人员开发了一种名为可学习子空间投影(LSP)的新方法来压缩神经网络,特别是Transformer。与使用局部标准的先前技术不同,LSP针对全局目标(如与原始模型输出分布的KL散度或训练损失)进行端到端子空间优化。这种方法通过防止网络深度中的误差累积,实现了更有效的压缩,尤其是在更高压缩率下。LSP在OPT、Qwen3、Llama-2和ViT-B/16等模型上表现出优越的性能,在显著的压缩水平下实现了比基线方法更好的困惑度和准确性。 AI
影响 该方法可以通过降低大型语言模型的计算和内存需求,从而实现更高效的部署。
排序理由 详细介绍神经网络压缩新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
- arXiv
- Hugging Face
- Learnable Subspace Projections
- LLaMA-2 7B
- OPT-125M
- OPT-1.3B
- Qwen3-4B
- ViT-B/16
- WikiText-2
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →