PulseAugur
实时 08:26:06
实体 Ampere

Ampere

PulseAugur coverage of Ampere — every cluster mentioning Ampere across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
11
90 天内 57
发布 · 30天
0
90 天内 0
论文 · 30天
5
90 天内 12
层级分布 · 90 天
主题
关系
时间线
  1. 2026-05-14 regulatory Companies are receiving regulatory warnings due to significant deviations between their earnings forecasts and audited financial results. 来源
  2. 2026-05-12 funding Amp secured $1.3 billion in funding to build an AI compute grid.
  3. 2026-05-12 funding China's A-share market margin trading and securities lending balance exceeded 2.8 trillion yuan. 来源
  4. 2026-05-12 funding Listed companies reduced their investment in wealth management products by approximately 50% year-on-year. 来源
情绪 · 30 天

6 天有情绪数据

最近 · 第 1/3 页 · 共 57 条
  1. COMMENTARY · CL_209909 ·

    Anthropic 的 Claude 模型据称规避新兴的 AI Agent 标准

    据报道,Anthropic 不支持 Agents and Actions Markdown 标准,该标准在其他 AI 编码工具中日益普及。开发者发现该标准有助于 AI Agent 理解代码库。相比之下,Anthropic 自有的 Claude.md 格式被认为过于局限于其自身工具,对于更广泛的协作效果不佳。

  2. TOOL · CL_206930 ·

    Nvidia CMP 170HX 挖矿 GPU 被破解以解锁 64GB VRAM

    一款名为 CMP Unlocker 的软件修改已被开发出来,用于恢复 Nvidia 的 CMP 170HX 加密货币挖矿 GPU 上先前被禁用的 VRAM。此破解允许显卡访问高达 64GB 的 VRAM,比其原始的 8GB 容量增加了八倍,并且还恢复了一些计算性能和更快的 PCIe 接口速度。CMP 170HX 基于 A100 加速器中使用的 GA100 Ampere 芯片,其内存被 Nvidia 因产品细分而禁用,尽管尚不清楚部分禁…

  3. TOOL · CL_200144 ·

    CAKE框架协同设计编译器代理以促进GPU内核演进

    研究人员开发了CAKE,一个新颖的协同设计框架,它整合了编译器技术和AI代理以增强GPU内核演进。该系统允许代理编写一种称为CAKE IR的专业中间表示(IR),该IR详细说明了硬件调度、内存移动和同步。该框架旨在提高专家GPU内核的可复现性和性能,超越将编译器视为黑箱的局限性。早期结果显示,在NVIDIA GPU上,Flash-KMeans和Kimi Delta Attention等应用程序的速度显著提升,并有可能实现更广泛的内核泛化。

  4. RESEARCH · CL_197038 ·

    CoreWeave 签署 2029 年 A100 GPU 合同,证明旧款 AI 硬件的价值

    CoreWeave 是一家专注于 AI 基础设施的云服务提供商,已签署一份直至 2029 年的 NVIDIA A100 GPU 合同,证明了旧款 AI 硬件的持续盈利能力。尽管人们担心 GPU 会迅速过时,但 CoreWeave 的首席执行官强调,这些上一代 GPU 的定价仍然坚挺。这种长寿部分归因于遗留数据中心的供电和散热限制,这使得部署像 NVIDIA 的 Blackwell 架构这样更新、更耗电的 GPU 变得困难,从而使旧款硬件保持需求。

  5. RESEARCH · CL_195577 ·

    NVIDIA与金融巨头合作,为超过5000亿美元的AI基础设施建设提供资金

    NVIDIA正与Apollo、BlackRock、Blackstone、Brookfield、Goldman Sachs和KKR等主要金融机构合作,建立融资平台。这些平台旨在调动超过5000亿美元的第三方资本,以支持AI基础设施的扩展。这一举措标志着将AI工厂作为生产性基础设施资产进行融资的转变,类似于传统基础设施项目,利用NVIDIA的计算平台、CUDA等软件创新以及广泛的生态系统来确保长期价值和收入产生。

  6. TOOL · CL_195336 ·

    Decoupled Descent 训练方法有望实现精确的训练-测试误差跟踪

    一种名为 Decoupled Descent (DD) 的新训练方法被提出,以解决训练误差下降而测试误差停滞或增加的问题。该方法在一篇理论论文中详细介绍,利用了高维统计理论的技术,特别是近似消息传递,以确保在每个参数迭代中,训练误差渐近地等于测试误差。该论文认为,这种方法可以为神经网络带来更好的最优停止和超参数调整策略,并有可能在未来应用于 SGD 和更通用的模型。

  7. TOOL · CL_187195 ·

    新的1RSB-AMP方法改进了稀疏信号重构

    研究人员开发了一种使用单步复制对称性破缺(1RSB)近似消息传递(AMP)技术重构稀疏信号的新方法。这种方法称为1RSB-AMP,扩展了现有的信念传播方法并提供了明确的更新规则。该研究分析了1RSB-AMP的相图,识别了成功、失败和发散区域,并提出了一种通过最小化发散区域来确定Parisi参数的新标准。当与非凸性控制协议相结合时,与以前的方法相比,该方法在完美重构的算法极限方面显示出适度的改进。

  8. TOOL · CL_164582 ·

    新的 GGUF Q8_CR 格式针对特定 GPU 优化了扩散模型

    一种名为 Q8_CR 的新 GGUF 格式已被开发出来,旨在针对 Ampere 和 Turing 等特定 GPU 架构优化扩散模型。该格式利用 ComfyUI 的 INT8 内核,并旨在最大限度地减小 INT8 和 FP16 检查点之间的质量差异。Q8_CR 将线性权重存储为预旋转的 INT8 和 FP32 标度,同时为敏感张量保留精度,与标准的 Q8_0 和 FP16 格式相比,提供了更快的推理速度和更少的 VRAM 使用量。

  9. TOOL · CL_168272 ·

    NVIDIA GPU的Warp Divergence行为在不同架构中保持稳定

    一篇新论文分析了从Pascal到Blackwell的NVIDIA GPU架构中的Warp Divergence。研究发现,发散路径会随着路径数量线性串行化,这种行为自Pascal一代以来一直保持一致。虽然发散的核心性能成本一直可预测,但NVIDIA在其编译器发出的重新收敛机制和控制流指令方面,在Ampere、Hopper和Blackwell等架构中已显著发展。

  10. TOOL · CL_160180 ·

    研究人员开发 GPU 侧信道方法来验证 LLM 训练 FLOPs

    研究人员正在开发一种方法,利用侧信道 GPU 读数来验证大型语言模型(LLM)的训练 FLOPs,旨在为评估前沿人工智能模型提供一种可量化的方式。该方法建立在 EpochAI 等机构现有工作的基础上,结合了功耗监测和实时利用率数据。该项目使用 Nvidia Jetson Orin Nano 来模拟 LLM 训练工作负载,并观察功耗和内存带宽利用率等信号。这项技术可以实现对人工智能训练计算的独立验证,填补了当前人工智能政策和国际协议中的空白。

  11. TOOL · CL_160035 ·

    Nvidia RTX 3090 和 3050 组合,通过无损缩放技术实现 144 FPS 4K 游戏

    一位游戏爱好者成功将 NVIDIA RTX 3090 与 RTX 3050 配对,利用无损缩放软件在 4K 分辨率下实现了 144 FPS。该设置将帧生成任务卸载到辅助的 RTX 3050,使主 RTX 3090 专注于渲染。无损缩放是一款在 Steam 上价格实惠的工具,与游戏和应用程序兼容性广泛,即使是那些不支持 DLSS 或 FSR 等原生 AI 画面提升和帧生成技术的应用程序也能兼容。这种方法为提升旧硬件的性能提供了一种经济高…

  12. TOOL · CL_170193 ·

    Nota AI 发布面向 NVIDIA Blackwell 的 4 位量化 Solar Open2 250B 模型

    Nota AI 发布了 Upstage 的 Solar Open2 250B 模型的 4 位量化版本,命名为 Solar Open2 250B — Nota NVFP4。新版本采用了 Nota AI 专有的量化技术,专门针对混合专家(MoE)大语言模型设计。运行此模型的一个关键要求是 NVIDIA Blackwell 架构,因为它利用了该系列中引入的 FP4 张量核心。

  13. TOOL · CL_153120 ·

    社区插件实现Nvidia RTX 50系列GPU精细VRAM温度监控

    一个硬件爱好者社区开发了一个名为Hotspot.dll的插件,该插件能够为Nvidia的RTX 50系列(Blackwell)GPU启用精细的VRAM温度监控。该插件兼容MSI Afterburner,并可能集成到HWiNFO等其他工具中,它提供了每个内存模块的详细热数据,这些数据之前无法通过标准的Nvidia API访问。这一突破使用户能够更好地微调显卡的性能和诊断问题,并将功能扩展到之前的RTX系列。

  14. TOOL · CL_144435 ·

    Nvidia 复活 RTX 3060 GPU 以应对 AI 驱动的硬件短缺

    Palit 已正式宣布重新推出其 GeForce RTX 3060 Infinity 2 OC,这是一款 2021 年的 GPU,旨在解决因 AI 热潮而加剧的零部件短缺问题。Nvidia 此举,以及 Gigabyte 和 Manli 等其他制造商的行动,旨在提供 12GB 显存选项,以应对不断上涨的硬件成本。虽然 RTX 3060 提供了大量的显存,但尽管显存较少,仍推荐使用更新的 RTX 50 系列显卡以获得更优越的性能和功能。

  15. TOOL · CL_152475 ·

    Action Map Policy 将机器人操作重构为图像分类问题

    研究人员推出了一种新颖的机器人学习方法——Action Map Policy (AMP),它将3D闭环操作重构为图像空间分类问题。该方法通过将3D操作投影到相机图像平面,并将每个像素视为一个离散类别,从而解决了高维操作空间带来的挑战。这种维度控制使得在可管理的词汇量下实现毫米级精度,并在各种操作任务中在成功率和推理速度上优于现有基线。

  16. RESEARCH · CL_139540 ·

    新的大语言模型研究涵盖多模态对齐、推理审计和能源使用 · 已追踪 10 个来源

    近期研究探讨了大语言模型(LLM)能力和局限性的各个方面。一项研究调查了多模态大语言模型的对齐问题,提出了一种新的数据生成方法来提高图像-文本一致性。另一篇论文介绍了一种用于评估大语言模型推理的协议级审计,突出了基准分数与实际行为属性之间的差异。进一步的研究利用围棋死活题探究了大语言模型的推理效率,揭示了当前模型在搜索组织方面存在困难。此外,还有研究考察了大语言模型的能耗、默认设置和代币定价对推理服务的影响,以及低资源编程语言基准的开发。

  17. COMMENTARY · CL_99070 ·

    AMP创始人表示,AI扩展依赖于效率,而非仅仅是更多的GPU

    AMP创始人Anjney Midha认为,AI扩展的争论应侧重于最大化现有GPU的效率,而不是仅仅购买更多GPU。他指出,前沿AI实验室通常在较低的模型浮点运算利用率(MFU)下运行,有些运行的MFU低于10%,远低于GPT-3的21%或PaLM的46%等历史基准。Midha强调,AI开发日益成为一个系统性问题,涉及调度、网络和数据管道,而AMP旨在创建一个计算网格,能够像电网一样高效地分配计算能力。

  18. COMMENTARY · CL_99291 ·

    AMP创始人表示,AI基础设施正从关注FLOPs转向关注兆瓦

    AMP创始人Anjney Midha在The AI Frontier播客节目中讨论了AI基础设施不断变化的格局。他强调,从关注计算能力(FLOPs)转向关注能源消耗(兆瓦)是扩展AI模型的关键因素。Midha还谈到了硬件效率日益增长的重要性以及Google等公司在开发专用AI芯片方面所发挥的作用。

  19. COMMENTARY · CL_85927 ·

    AI代理在长上下文压缩策略上存在分歧

    一位Reddit用户分析了包括Claude Code和Cursor在内的六个AI代理如何通过压缩技术处理长上下文窗口。虽然大多数代理优先考虑最近的用户消息和有状态的工具输出,但它们在处理旧的助手消息和压缩过程的透明度方面存在差异。该用户认为,明确沟通上下文退化对于模型准确推理至关重要,并强调了令牌效率与上下文准确性之间的权衡。

  20. SIGNIFICANT · CL_77228 ·

    蚂蚁集团推出面向代理商务的全球AI支付协议

    蚂蚁集团推出了Agentic Mobile Protocol (AMP),以促进全球AI驱动的商务活动。该协议解决了新兴AI代理市场中商家和消费者的关键挑战,包括安全便捷的支付、代理身份验证以及跨市场互操作性。AMP旨在为AI驱动的交易创建一个统一、可信的基础设施,使企业能够通过单一集成在全球范围内运营,并为消费者提供增强的安全性和对其AI代理支出的控制权。