PulseAugur
实时 14:56:09
实体 DeepSeek-R1 671B

DeepSeek-R1 671B

PulseAugur coverage of DeepSeek-R1 671B — every cluster mentioning DeepSeek-R1 671B across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 3 条
  1. TOOL · CL_68380 ·

    新框架加速 NVIDIA H20 GPU 上的 LLM 推理

    研究人员开发了 FlashMLA-ETAP,一个旨在显著加速 NVIDIA H20 GPU 上大型语言模型推理的新框架。该框架引入了高效转置注意力流水线 (ETAP),重新配置注意力计算以减少冗余操作。与现有方法(如 FlashMLA)相比,在 64K 的序列长度下,这种方法实现了 2.78 倍的加速,同时还表现出卓越的数值稳定性。

  2. RESEARCH · CL_57021 ·

    雷神与AMD推出面向大模型的AI工作站

    雷神与AMD合作推出全面的AI工作站产品线,涵盖塔式、迷你PC和移动形态。这些新机器旨在满足日益增长的AI计算能力需求,特别是运行大型语言模型和基于代理的应用程序。产品系列包括配备AMD Threadripper PRO 9995WX和多个AI Pro R9700加速器的AI Master T9000等高端型号,能够微调130B模型,以及满足各种用户需求的更易于获得的选项。

  3. RESEARCH · CL_53463 ·

    百度搜索部署大语言模型进行查询驱动事件时间线摘要

    研究人员开发了QDET系统,用于百度搜索,可根据用户查询生成聚焦的事件时间线。QDET利用多任务微调和强化学习进行简洁摘要,在一个7B参数模型上实现了高性能,可媲美更大的模型。该系统通过A/B测试展示了实际效果,提高了百度搜索的点击率和用户参与度。