PulseAugur
中
实时 16:55:06
实体 Hypernova 60B

Hypernova 60B

PulseAugur coverage of Hypernova 60B — every cluster mentioning Hypernova 60B across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. RESEARCH · CL_215976 ·

    新的LLM压缩技术带来更小、更精确的模型

    研究人员开发了新的方法来压缩大型语言模型(LLM),同时保持甚至提高其性能。一种方法是量化感知修复(QAH),它直接从原始未压缩模型中蒸馏出一个压缩的4位模型,从而得到一个更小、更精确、更高效的模型,在多个基准测试中优于其全精度对应模型。其他研究探索了激活加权种子残差编码(AWSRC)等技术来修复量化误差,以及一个名为“压缩三位一体”的统一框架,该框架联合应用稀疏性、量化和低秩近似来实现高效的LLM部署。此外,还创建了一个标准化的评估…

  2. TOOL · CL_191807 ·

    新技术大幅降低了LLM知识蒸馏的成本

    研究人员开发出一种更高效的大型语言模型知识蒸馏方法,显著降低了计算成本和内存需求。这项新技术包括缓存教师模型的top-K logits并采用融合的、分块的KL散度损失,从而避免了物化大型张量。这些优化使得在更易获得的硬件(如单个GPU)上进行大规模实验和长上下文修复成为可能。