PulseAugur
实时 05:46:58
实体 Nvidia H20

Nvidia H20

PulseAugur coverage of Nvidia H20 — every cluster mentioning Nvidia H20 across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
3
90 天内 5
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

2 天有情绪数据

最近 · 第 1/1 页 · 共 5 条
  1. TOOL · CL_206292 ·

    新的AI训练方法使数字虚拟形象能够实时适应

    研究人员开发了一种名为束缚感知训练(Harness-Aware Training, HAT)的新训练方法,使AI代理(特别是用于直播电商的数字虚拟形象)能够在无需完全重新训练的情况下适应不断变化的业务策略和需求。该方法将技能、提示和工具与模型的核心权重解耦,从而允许在运行时进行修改。HAT方法(包括束缚状态增强HSA)在直播问答和束缚变体问答基准测试中表现出色,性能优于基础模型和通用大语言模型,同时保持了适合实时应用的低延迟。

  2. RESEARCH · CL_205512 ·

    ByteDance 和 清华AIR 训练大语言模型使用 CUDA Agent 编写更快的 GPU 代码

    ByteDance Seed 和 清华AIR 开发了 CUDA Agent,一个使用强化学习训练大语言模型生成优化 GPU 核的系统。该系统在 KernelBench 基准测试中达到了 98.8% 的正确率,并且生成的核比编译器生成的代码快 96.8% 的时间。该 Agent 在模拟的 CUDA 开发环境中运行,结合了性能分析和正确性检查来提高核性能,在 AI 基础设施和其他延迟敏感领域具有潜在应用。

  3. TOOL · CL_164745 ·

    本地 LLM 为机器人手臂提供动力,实现逼真的智能手机电池测试

    一位 YouTube 评测者开发了一个先进的智能手机电池测试系统,利用本地大型语言模型 (LLM) 控制机器人手臂。该设置采用了两个 Qwen 模型,一个用于快速浏览的混合专家 35B 模型,以及一个用于精确操作的更大的 27B 模型,以极低的延迟模拟人类使用手机。评测者在专用硬件上投入了大量资金,包括 NVIDIA H20 和 RTX PRO 6000,以确保实时推理并防止网络波动影响测试结果。

  4. RESEARCH · CL_131724 ·

    智谱AI在算力短缺和美国管制下探索定制芯片设计

    中国领先的人工智能实验室智谱AI正在考虑设计自己的定制人工智能处理器,以应对飙升的需求和美国的出口管制。此举将使该公司转型为一个垂直整合的人工智能平台,超越单纯的模型开发。该计划的驱动因素是对计算资源日益增长的商业需求,正如其GLM-5.2模型快速增长所证明的那样,以及减少对西方供应链依赖的地缘政治必要性,尤其是在被列入美国商务部实体清单之后。据报道,智谱AI正在与中国芯片设计公司进行早期讨论,潜在的定制芯片开发可能需要两年多的时间。

  5. TOOL · CL_131495 ·

    新的LLM服务优化方法优先考虑估算而非性能剖析

    一篇新的研究论文提出了一种用于优化大型语言模型(LLM)服务的“先估算后细调”(Floor-First)策略工作流。该方法优先考虑估算而非繁重的性能剖析,将每个解码步骤建模为一个资源向量,以确定重叠质量,然后再诉诸于性能剖析器。该方法通过识别随着负载增加哪个资源将首先成为瓶颈,而不是仅仅依赖于点基准测试,来比较部署替代方案。作为案例研究,该论文分析了在NVIDIA H20 GPU上运行的DeepSeek-V3.2风格的671B MoE…