研究人员开发了一种名为可学习子空间投影(LSP)的新方法来压缩神经网络,特别是Transformer。与之前使用局部标准的旧技术不同,LSP通过联合优化正交投影仪以实现全局目标,来端到端地学习要丢弃的子空间。这种方法旨在防止深层网络中的误差累积,并在各种LLM和视觉Transformer上展现出优越的性能,尤其是在更高的压缩率下。该方法还提高了注意力机制的解码速度和内存使用效率。 AI
影响 这项新的压缩技术可以使大型语言模型在资源受限的设备上更有效地部署。
排序理由 该项目是一篇研究论文,详细介绍了一种新的神经网络压缩方法。[lever_c_demoted from research: ic=1 ai=1.0]
在 Hugging Face Daily Papers 阅读 →
- Hugging Face
- Language Server Protocol
- Learnable Subspace Projections
- LLaMA-2 7B
- OPT-125M
- OPT-1.3B
- Qwen3-4B
- ViT-B/16
- WikiText-2
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →