研究人员推出了一种新颖的循环 Transformer 架构 T-LoopFormer,旨在增强推理和语言任务。该新模型采用动态令牌选择路由机制,允许每个令牌根据其隐藏状态调整计算深度。这种自适应方法确保简单令牌绕过不必要的处理,而复杂令牌则接受更深入的分析,从而优化计算分配。此外,T-LoopFormer 采用递归式 KV 缓存,为每个循环维护独立的缓存,防止冗余计算并提高解码效率。实验表明,与现有模型相比,T-LoopFormer 以更少的参数和更低的推理延迟实现了最先进的性能。 AI
影响 优化了循环 Transformer 中的计算分配和推理延迟,有望带来更高效的推理模型。
排序理由 该集群描述了一篇介绍新模型架构和技术的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
- dynamic token-choice routing
- Hugging Face
- Looped Transformers
- recursion-wise KV caching
- T-LoopFormer
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →