一个名为 lightx2v/Minimax-h3-Turbo-SLA 的新的 LoRA (Low-Rank Adaptation) 模型已发布,为 MiniMax-H3 模型提供了显著的推理速度提升。该蒸馏模型采用了 85% 稀疏率的稀疏线性注意力 (SLA),在 NVIDIA RTX 5090 上实现了约 2.5 倍的更快推理速度,同时保持了视觉质量。该模型支持 768p FL2V 生成,并兼容 LightX2V 和 ComfyUI 工作流,运行需要原始 MiniMax-H3 模型。 AI
影响 加速视频生成模型的推理,可能实现更高效的工作流和实时应用。
排序理由 发布了具有性能改进和技术细节的新 LoRA 模型。
在 Hugging Face Trending Models 阅读 →
- ComfyUI
- Jiang, Kaiwen
- LightX2V
- lightx2v/Minimax-h3-Turbo-SLA
- MiniMaxAI/MiniMax-H3
- MiniMax-H3 Turbo-SLA
- NVIDIA RTX 5090
- Sparse–Linear Attention
- Stoica, Ion
- Wang, Haoxu
- Wang, Ziteng
- Xi, Haocheng
- Zhao, Min
- Zheng, Kaiwen
- Zhu, Hongzhou
- LoRA
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →