PulseAugur
实时 17:48:26
实体 SageMaker HyperPod

SageMaker HyperPod

PulseAugur coverage of SageMaker HyperPod — every cluster mentioning SageMaker HyperPod across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 5
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
时间线
  1. 2026-08-24 product_launch AWS announced new Ray capabilities integrated into SageMaker HyperPod for foundation model training and serving. 来源
  2. 2026-07-10 product_launch AWS announced the implementation of Disaggregated Prefill and Decode (DPD) for LLM inference on SageMaker HyperPod. 来源
  3. 2026-07-10 product_launch AWS SageMaker HyperPod now supports disaggregated prefill and decode for LLMs. 来源
情绪 · 30 天

2 天有情绪数据

最近 · 第 1/1 页 · 共 5 条
  1. TOOL · CL_236402 ·

    AWS 和 NVIDIA 发布 Cosmos 3 物理 AI 模型工厂

    AWS 和 NVIDIA 已合作推出使用 SageMaker HyperPod 上的 NVIDIA Cosmos 3 构建的物理 AI 模型工厂。该系统旨在持续生成合成数据、训练感知和策略模型,并在模拟中进行评估,使机器人和自动驾驶汽车能够在现实世界中运行。NVIDIA Cosmos 3 模型采用 Transformer 混合架构,将视频、图像、动作和声音等多种模态整合到单一 token 流中,使其能够在 AWS 基础设施上通过统一的…

  2. TOOL · CL_217244 ·

    AWS SageMaker HyperPod 集成新 Ray 功能以进行基础模型训练

    Amazon SageMaker HyperPod 现在提供与开源 Ray 框架的增强集成,简化了基础模型的训练和部署过程。此更新允许数据科学家直接在 SageMaker Studio 中管理 Ray 集群,无需手动配置 Kubernetes 和复杂的命令行操作。该集成提供了自动容错、通过分层检查点更快地恢复作业,以及对仪表板和模型权重的简化访问。

  3. TOOL · CL_173479 ·

    Kimi K3 前沿模型部署在 AWS 上需要庞大的基础设施

    已成功演示了在 AWS 基础设施(特别是 SageMaker HyperPod 和 EKS)上部署开放权重前沿模型 Kimi K3。此次部署突显了在云平台上运行此类先进模型的可行性,但也强调了支持数万亿参数模型所需的重大基础设施要求。

  4. TOOL · CL_136232 ·

    AWS SageMaker HyperPod 推出分离式 LLM 推理以提高性能

    Amazon SageMaker HyperPod 现在支持大型语言模型 (LLM) 推理的分离式预填充和解码 (DPD) 技术。该技术将提示处理(预填充)和令牌生成(解码)阶段分离到不同的 GPU 池上,并通过支持远程直接内存访问 (RDMA) 的 Elastic Fabric Adapter (EFA) 进行连接。DPD 特别有利于长上下文、高并发的流式工作负载(例如聊天助手和 RAG 应用),因为它能防止长提示阻塞正在进行的解码…

  5. TOOL · CL_135910 ·

    AWS SageMaker HyperPod 通过分离式计算增强 LLM 训练

    AWS SageMaker HyperPod 已为大型语言模型 (LLM) 引入了对分离式预填充和解码阶段的支持。此新功能由 pdSpec 启用,允许团队使用 EFA RDMA 将这些阶段分离到专用的 GPU 池上。此次更新旨在提供一致的每 token 延迟,提高吞吐量,并允许独立扩展,同时管理 KV 缓存卸载。