H200
PulseAugur coverage of H200 — every cluster mentioning H200 across labs, papers, and developer communities, ranked by signal.
- used by ByteDance 90%
- instance of graphics processing unit 90%
- used by NVIDIA H100 70%
- competes with NVIDIA H100 70%
- used by Blackwell 70%
- used by RTX 4090 70%
- competes with MI300X 70%
- used by vLLM 70%
- competes with H.1000 Gnome 70%
- used by Supermicro 70%
- used by graphics processing unit 60%
- affiliated with Supermicro 60%
- 2026-08-19 product_launch First shipments of Nvidia's H200 AI chips have reached China, with ByteDance and Tencent as initial recipients. 来源
- 2026-05-14 product_launch US government approves sale of NVIDIA H200 AI chips to ten Chinese companies.
8 天有情绪数据
-
GPU云服务商排名:CoreWeave、Nebius、Lambda、Crusoe、Groq
一份新报告根据定价、合同算力和硬件路线图,对五家领先的GPU云服务商进行了排名:CoreWeave、Nebius、Lambda、Crusoe和Groq。CoreWeave凭借铂金级服务和最新NVIDIA GPU的高价位居榜首,而Nebius提供按需B300定价。Lambda提供最低的按需B200费率,Crusoe则独家提供AMD MI300X/MI355X。Groq,此前专注于其LPU架构,现已成为NVIDIA云合作伙伴,计划集成NV…
-
中国允许NVIDIA H200芯片进口,以促进国内人工智能与美国的竞争
中国已允许有限数量的NVIDIA H200芯片运往国内。此举旨在支持国内人工智能公司在美国快速发展的人工智能领域展开竞争。这些高性能芯片的可用性对中国公司保持技术均势至关重要。
-
英伟达 H200 AI 芯片运抵中国,但香港部署面临障碍 · 追踪 3 个来源
英伟达已开始向中国运送其 H200 AI 加速器,据报道,主要科技公司字节跳动和腾讯已收到约 10,000 件的首批货物。尽管有这些货物,北京方面正将大部分获批芯片导向香港,那里的基础设施限制可能会阻止其部署。此举似乎是北京方面在本土芯片制造商发展其能力的同时,维持对中国大陆市场影响力的策略,尽管这给接收公司带来了后勤挑战。
-
中国允许字节跳动和腾讯进口 10,000 块 NVIDIA H200 AI 芯片
据报道,中国已允许字节跳动和腾讯各进口 10,000 块 NVIDIA H200 芯片,此举旨在增强其 AI 模型开发能力。此决定似乎放宽了此前美国施加的限制,允许这些中国科技巨头获取先进处理器来训练前沿 AI 模型。据报道,这些芯片正通过香港转运,可能旨在支持中国国内芯片产业,同时仍使中国领先的公司能够在国际上竞争。
-
前沿AI代理需要TB级显存,自托管不可行
自托管前沿级AI代理需要大量的显存,远远超出典型消费级硬件的能力。例如,一个拥有6850亿参数的模型,仅其权重(8位精度)就需要约800GB显存,而上下文窗口需求和运行时开销会显著增加这一数字,轻松达到TB级别。微调会进一步成倍增加这些需求,需要更多的内存来存储梯度和优化器状态,将基础设施需求推向多节点集群,而非单个工作站。
-
Alaya-EVOKE 推出交互式世界模型,用于开放式视频生成
研究人员推出了 Alaya-EVOKE,一个专为开放式视频生成设计的交互式世界模型。该模型利用外部持久内存和一种新颖的长时域教师来实现低延迟的响应式生成。Evoke 通过外部化世界状态并重新设计教师以实现扩展监督,解决了维护历史和实现低延迟交互的挑战,在 WBench 等基准测试中取得了最先进的性能。
-
新的RASP-QAOA系统优化QAOA仿真
一篇新研究论文介绍了一个名为RASP-QAOA的系统,该系统旨在优化量子近似优化算法(QAOA)的仿真。RASP-QAOA会考虑图结构、电路深度、精度和可用内存等因素,为每个特定的QAOA实例智能地选择最合适的计算表示和执行参数。在H200 GPU上的评估中,RASP-QAOA成功验证了所有可解的请求,并与CUAOA等现有方法相比,在选择准确性和遗憾方面表现更优。
-
Moonshot AI 发布 Kimi K3,拥有 2.8T 开放权重,但只有 1.8% 在运行
Moonshot AI 发布了 Kimi K3 模型,拥有 2.8 万亿开放权重,使其成为迄今为止最大的开放权重模型。然而,在这些参数中,只有一小部分,大约 1.8%,在处理每个 token 时被积极使用。这种稀疏性意味着,虽然该模型拥有庞大的参数数量,但实际的计算和内存需求与同等规模的密集模型相比要低得多,尽管仍然很大,需要大约 1488 GB 的 VRAM。
-
Moonshot AI 发布 2.8T Kimi K3 权重,规模空前但难以运行
Moonshot AI 已发布其 Kimi K3 模型的全部 2.8 万亿参数权重,使其成为迄今为止最大的开放权重模型。尽管规模庞大且已公开发布,但由于其极高的显存需求(估计超过 1.6TB),在消费级硬件上运行 Kimi K3 实际上是不可能的。此次发布凸显了开放权重运动中的一种紧张关系,即由于部署所需的大量基础设施,模型的商品化可能并不等同于人工智能能力的真正民主化。
-
Induction Labs 发布 Photon-1 想象模型,性能超越 Gemini
Induction Labs 推出了 Photon-1,这是一个拥有 1060 亿参数的混合专家模型,在没有动作标签的原始视频上进行训练。这种“想象模型”架构在学习到的表示空间中预测未来帧,使其能够隐式地推断动作。据报道,Photon-1 在内部基准测试中表现优于 Gemini 3.1 Flash-Lite,使用的预训练计算量显著减少,服务成本也更低。该模型通过编码帧差实现了高压缩率,并使用 PyTorch 在 5.75 亿帧上进行了…
-
GMI Cloud 在 2026 世界人工智能大会上发布全栈 AI 解决方案
GMI Cloud 在 2026 世界人工智能大会上展示了其全面的 AI 基础设施解决方案,重点介绍了其 AI Cloud、MaaS 和 Agentbox 平台。作为 NVIDIA 云合作伙伴,GMI Cloud 提供由 GB300 和 GB200 等高性能芯片驱动的 GPU 云服务,并在台北设有著名的“AI Factory”集群。该公司还展示了用于资源管理的 Cluster Engine、用于模型访问的 Inference Engi…
-
LLM云GPU租赁指南:按模型大小优化成本
2026年运行大型语言模型(LLM)的最佳云GPU租赁方案取决于具体的模型大小和工作负载,重点在于每美元的token数而非每小时费率。对于较小的模型(7B-13B),推荐使用经济实惠的RTX 4090;而34B模型则适合使用48GB显卡的RTX 6000 Ada或A100 80GB。较大的70B模型可使用A100或H100 GPU,而两个RTX 4090是更具成本效益的替代方案。对于前沿模型或长上下文窗口,H200和B200 GPU提…
-
拆解视频详细展示 NVIDIA H200 GPU 液冷安装
一段详细的视频展示了 NVIDIA H200 NVL GPU 的拆解过程以及 EK-Pro H200 NVL 水冷块的安装。该过程包括分离 PCB、清洁和更换导热垫及导热膏,以及小心地重新组装组件。视频还演示了 8 路 H200 液冷服务器机架的 24 小时泄漏测试和压力测试,该机架在满负荷运行时功耗约为 7,000W,GPU 温度保持在 76-81°C 之间。
-
美国称英伟达H200 AI芯片出口中国仍“微不足道”
美国表示,尽管近期已获批准,但英伟达(Nvidia)的H200 AI芯片出口到中国数量一直很少。一位商务部高级官员表示,只有极少数芯片已运往中国大陆和香港,认为数量“微不足道”。这些销售不包括英伟达最先进的Blackwell芯片,是持续的中美AI竞争中的一个重要进展。
-
美国允许中兴通讯购买英伟达H200 AI芯片,跻身科技精英行列
美国政府已批准中国电信公司中兴通讯购买英伟达的H200 AI芯片。此举使中兴通讯得以加入包括阿里巴巴、腾讯和字节跳动在内的一批已获准采购英伟达Hopper代硬件的中国科技公司之列。然而,此次批准的实际影响可能受到中国自身国内芯片产业计划和监管障碍的限制。
-
英伟达限制在亚洲销售人工智能芯片以遏制走私 · 跟踪到2个来源
据报道,英伟达正在收紧在亚洲的客户名单,以打击其人工智能芯片的走私,特别是走私到中国。据称,该公司在实施了更严格的合规检查(包括现场检查和客户访谈)后,已将其授权客户群减少了一半。此举是在华盛顿的压力下进行的,并且正值对涉及Supermicro等合作伙伴的芯片走私行动进行调查之际。
-
全球人工智能需求激增,中国芯片出口飙升 · 跟踪1个来源
受全球人工智能热潮和强劲的计算硬件需求推动,中国上半年芯片出口几乎翻倍。集成电路出口同比增长超过96%,成为中国整体出口增长的重要因素。中国也在推动国内芯片生产,并批准向本地科技公司销售NVIDIA H200等先进人工智能芯片。
-
Tencent and VIDRAFT showcase sparse MoE models with reduced active parameters
Tencent has released Hy3, a 295-billion-parameter Mixture-of-Experts (MoE) model that utilizes only 21 billion active parameters per forward pass, significantly reducing inference costs. This MoE architecture, featuring…
-
由于人工智能增长,爱尔兰数据中心消耗23%的国家电力
爱尔兰的数据中心消耗了该国相当大一部分的电力,达到了国家总量的23%。这种能源需求的激增主要是由人工智能基础设施的扩张推动的,像Microsoft和OpenAI这样的公司都增加了电力消耗。这种增长凸显了对环境可持续性的追求与人工智能技术的快速采用之间日益增长的紧张关系。
-
新的CTA-pipelining方法大幅降低LLM的多GPU延迟
研究人员推出了一种新颖的多GPU系统执行范式CTA-pipelining,该范式针对服务大型语言模型的延迟进行了优化。该方法利用了协同线程阵列(Cooperative Thread Array)层面的依赖关系,从而实现跨GPU的并发内核执行。在H200和B200系统上的实验表明,CTA-pipelining可以将特定操作的延迟降低高达31.8%,并且可以与张量并行(Tensor Parallelism)结合以获得进一步的性能提升。