Nvidia GTC
PulseAugur coverage of Nvidia GTC — every cluster mentioning Nvidia GTC across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
英伟达据称正测试低内存Rubin Ultra,因HBM短缺
据报道,由于预计将出现高带宽内存(HBM)短缺,英伟达正在为其即将推出的Rubin Ultra加速器探索降低内存配置的方案。目前正在测试的方案内存容量低至192 GB,相较于此前宣布的1 TB HBM4E有大幅下降。此举可能还涉及从更先进的HBM4E回退到HBM4,因为HBM4E面临供应链复杂性问题。该公司表示其路线图保持不变,但有报道称可能出现延迟,并且正在持续测试各种内存容量和配置。
-
AI推理芯片初创公司源川微获数亿元融资
专注于AI推理LPU(语言处理单元)架构的初创公司源川微,在IDG资本领投的Pre-A轮融资中获得了数亿元人民币。这是该公司自2025年9月成立以来的第四轮融资。资金将用于LPU+芯片的研发、软件生态建设和产品工程。源川微旨在通过提供更快、更稳定的推理来创造更高价值,尤其是在蓬勃发展的Agent时代,以此区别于Groq等竞争对手,而非仅仅追求成本效益。
-
英伟达(NVIDIA)GTC主题演讲展示的AI硬件规模令人印象深刻
演讲者通常不是硬件爱好者,但对英伟达(NVIDIA)CEO黄仁勋最近的GTC主题演讲印象深刻。演讲突显了AI硬件行业取得的重大进展和规模,演讲者因此推荐那些希望了解该领域发展方向的人观看此次演讲。
-
新框架用 LLM 裁判解决 AI 代理验证问题
一个名为 AgentProof 的新框架旨在解决验证 AI 代理质量和可靠性的挑战。该系统记录代理的操作,允许回放和检查,但核心问题仍然是确定代理的输出是否真的好。本文介绍了一种使用 LLM 裁判的方法,该裁判在严格的规则下运行,以对代理性能提供可辩护的判决,区分捏造信息的代理和诚实报告失败的代理。
-
三星为NVIDIA的AI平台量产先进SSD
三星电子已开始量产其先进的数据中心固态硬盘PM1763。该硬盘专为NVIDIA即将推出的Vera Rubin平台设计,该平台面向AI数据中心。PM1763采用了最新的V-NAND闪存和新的4nm控制器,读写速度是上一代的两倍多,并集成了液冷系统,以最大限度地减少AI加速器的数据延迟。
-
英伟达通过优化的推理栈实现实时视频扩散
英伟达展示了一种新的视频扩散模型方法,该方法显著缩短了生成时间,使得在单个 GPU 上进行实时视频生成成为可能。这项在英伟达 GTC 上提出的进展侧重于优化推理栈,而不是开发更大的模型。该解决方案的核心涉及一个可组合的三种技术栈:量化、缓存和蒸馏,这些技术共同提高了性能。
-
作者承认Agentic AI已稳定,重新拥抱工程
作者反思了过去对Agentic AI的怀疑,承认自己对其局限性的看法是错误的。他们宣布,长期运行的Agent已变得稳定,这促使他们重新拥抱“Agentic Engineering”。文章还提到了完成硕士学位、在自主移动机器人平台上工作、参加NVIDIA GTC以及继续参加AI聚会,同时也提及了个人活动和离开高通的感想。
-
Together AI 发布开源 Hot Wings 模型用于推理
Together AI 发布了一个名为 Hot Wings 的新开源模型,专为推理设计。该公司在 NVIDIA 的 GTC 会议上展示了该模型,突出了其功能。此次发布旨在为开源社区提供一个强大且易于访问的选项。
-
Together Computer 在GTC上展示漫画书生成应用
Together Computer 开发了一款可以生成漫画书的应用。该应用在GTC会议上进行了展示,与会者可以在现场创作并打印自己的漫画书。
-
Microsoft 的 Advanced Shader Delivery 将 Forza Horizon 6 的加载时间缩短了 95%
Microsoft 推出了 Advanced Shader Delivery (ASD) 技术,通过预编译着色器显著缩短游戏加载时间。此功能现已通过 Xbox PC 应用在 Windows 11 PC 上支持 RDNA 3 及更高版本的 AMD GPU,可将启动时间最多缩短 95%。ASD 通过从针对用户特定硬件配置量身定制的云数据库下载预编译的着色器来工作,消除了设备上编译的需要。
-
NVIDIA GTC 采访讨论世界模型和 Nemotron
一位用户分享了他们在 GTC 上采访 NVIDIA 高管关于世界模型和 Nemotron 项目的个人经历。虽然讨论涉及人工智能行业的知名人士和话题,但尚未透露任何具体的技术见解或新信息。用户的叙述侧重于个人互动,而非技术细节。
-
AI 热潮加剧数据中心压力,突破电力和连接极限
Microsoft 的 AI 驱动云需求显著超出其交付能力,Azure 收入同比增长 123%,已签约但未交付的服务积压达到 6270 亿美元。这种需求正在给数据中心容量带来压力,尤其是在电力和冷却方面,导致部署时间延长。瓶颈已从半导体供应转移到电网到芯片的接口,电力供应现在决定着 AI 基础设施扩展的速度。
-
汽车制造商利用人工智能大幅缩短汽车设计和开发时间
汽车制造商越来越多地利用人工智能来加速汽车设计过程,显著缩短了从初始草图到3D模型的时间。Vizcom等工具允许设计师在几小时内从手绘草图生成详细的3D模型和动画,而这在以前需要数月时间。此外,人工智能还被应用于计算流体动力学模拟,大大缩短了空气动力学测试所需的时间,捷豹路虎等公司报告称节省了大量时间。
-
李飞飞3D新技术引热议,这家深圳公司两年前为何“不屑一顾”?
人工智能先驱李飞飞最近强调了3D高斯溅射(3DGS)在流式传输超过一亿个溅射点方面的进展,而一家名为XGRIDS的深圳公司声称早在两年前就已实现类似的移动流式传输能力。3DGS普及的核心挑战不在于技术可行性,而在于展示切实的价值和与现有工作流程的整合,这类似于视频的“MP4时刻”。XGRIDS的LCC解决方案侧重于将3D数据作为生产流程中的可用资产,而不仅仅是视觉显示,通过解决数据大小、传输和与行业工具兼容性等问题。
-
NVIDIA推出用于自然语言控制和仿真的新AI机器人工具
NVIDIA宣布了多项新工具和模型,以加速AI驱动的机器人开发。其中包括用于自然语言指令遵循的NVIDIA Isaac GR00T开放模型以及用于合成数据生成的NVIDIA Cosmos世界模型。该公司还发布了开源物理引擎Newton 1.0,并扩展了其Isaac Sim仿真功能。这些进步旨在使机器人能够更有效地从虚拟训练过渡到现实世界部署。