PulseAugur
实时 02:10:48
English(EN) Session-Adaptive Orthogonal Distillation (SAOD)? Technology compresses 744B (1.5TB) to under 100GB?

新的 SAOD 技术将 744B LLM 从 1.5TB 压缩至 100GB 以下

一种名为 Session-Adaptive Orthogonal Distillation (SAOD) 的新技术被提出,旨在显著压缩大型语言模型。该方法旨在将一个拥有 7440 亿参数、当前占用 1.5TB 空间的模型压缩至 100GB 以下。其潜在影响是,如此规模的模型可能可以在仅配备 8GB VRAM 的硬件上运行。 AI

影响 使在消费级硬件上运行显著更大的模型成为可能,从而普及先进的 AI 能力。

排序理由 该条目描述了一种新的模型压缩技术方法,属于研究范畴。[lever_c_demoted from research: ic=1 ai=1.0]

在 r/LocalLLaMA 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

新的 SAOD 技术将 744B LLM 从 1.5TB 压缩至 100GB 以下

报道来源 [1]

  1. r/LocalLLaMA TIER_1 English(EN) · /u/pmttyji ·

    Session-Adaptive Orthogonal Distillation (SAOD) 技术将 744B (1.5TB) 压缩至 100GB 以下?

    <table> <tr><td> <a href="https://www.reddit.com/r/LocalLLaMA/comments/1v3shir/sessionadaptive_orthogonal_distillation_saod/"> <img alt="Session-Adaptive Orthogonal Distillation (SAOD)? Technology compresses 744B (1.5TB) to under 100GB?" src="https://preview.redd.it/tkgryjv1cueh1…