PulseAugur
实时 10:35:08
实体 IndexCache

IndexCache

PulseAugur coverage of IndexCache — every cluster mentioning IndexCache across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_117216 ·

    IndexCache 削减 LLM 计算量,通过跨层重用 token 选择

    研究人员开发了 IndexCache,一种通过减少大型语言模型中冗余计算来优化 DeepSeek Sparse Attention (DSA) 的方法。核心思想是模型中的相邻层通常选择相同的关键 token,使得每一层的索引器工作在很大程度上是冗余的。IndexCache 指定某些层为“完整”(F)层来计算和缓存 token 选择,而“共享”(S)层则重用这些缓存的选择,在不改变模型架构的情况下显著减少了计算量。

  2. TOOL · CL_107103 ·

    Papers with Code 重获新生,新增 SOTA 徽章和新的热门指标

    Hugging Face 更新了 Papers with Code,这是一个用于跟踪 AI 研究的平台。新功能包括支持最先进 (SOTA) 徽章,以突出基准测试中表现最佳的论文。此外,该平台现在使用热门分数,该分数结合了 GitHub 星标速度和 Hugging Face 工件的受欢迎程度,并且它支持论文摘要中未列出的外部评估。