PulseAugur
实时 21:47:29
实体 NVIDIA-Nemotron-3-Nano-30B-A3B-FP8

NVIDIA-Nemotron-3-Nano-30B-A3B-FP8

PulseAugur coverage of NVIDIA-Nemotron-3-Nano-30B-A3B-FP8 — every cluster mentioning NVIDIA-Nemotron-3-Nano-30B-A3B-FP8 across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 1 条
  1. RESEARCH · CL_91384 ·

    新研究探索极端LLM压缩技术

    两篇新研究论文提出了压缩大型语言模型(LLM)的新颖方法,以减小其内存占用并提高效率。第一篇论文《LLM Compression by Block Removal with Constrained Binary Optimization》将LLM压缩构建为一个二元优化问题,在Llama-3.3-70B-Instruct的MMLU基准测试上取得了显著的提升。第二篇论文《UltraSketchLLM》引入了一种使用数据草图的低于1比特的压…