Provisioned Throughput
PulseAugur coverage of Provisioned Throughput — every cluster mentioning Provisioned Throughput across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
AWS Bedrock 预置吞吐量:成本计算指南
Amazon Bedrock 提供预置吞吐量选项,用于专用的模型容量,按小时计费而非按 token 计费。这种固定容量模型对于自定义模型是必需的,但不支持批量推理或推理配置文件。为了确定预置吞吐量是否具有成本效益,用户必须从其 AWS 客户经理处获取特定的、未公开的详细信息,包括每个模型单元的每小时价格以及模型单元每分钟可以处理的输入/输出 token 数。
-
Together 引入 Kimi K3,Runway ML 发布 Workflows 及广告大赛
Together 宣布 Kimi K3 将于明日在其平台上线,提供每分钟固定吞吐量和保证的 token 数,99% 的正常运行时间和比 Fable 低 65% 的成本。与此同时,Runway ML 在其 Runway Agent 中推出了 Workflows,允许用户使用自然语言构建、运行和编辑基于节点的流程,以实现可扩展、高质量的输出。Runway ML 还在推广其“Another Big Ad Contest for Produc…
-
Together AI通过MiniMax M3预留吞吐量提供保证容量
Together AI为其MiniMax M3模型提供预留吞吐量(PTU),旨在提供保证容量并降低与闭源模型的成本。该公司强调生产SLA和基于令牌的定价是主要优势。Together AI还为潜在客户提供了估算其PTU需求和理解预留容量用于代理工作负载经济性的资源。
-
Together AI 推出 Provisioned Throughput 以保证推理容量
Together AI 推出了名为 Provisioned Throughput 的新无服务器产品,专为需要保证性能的企业级应用程序而设计。该产品提供专用的推理容量和基于 token 的定价,旨在与其他模型相比降低高达 90% 的成本。目前已支持 MiniMax AI 和 GLM-5.2。
-
Together Computer 推出面向开放模型的预留吞吐量
Together Computer 推出了预留吞吐量(Provisioned Throughput)服务,为前沿开放模型提供预留推理容量。这项新服务旨在提供具有基于 token 定价和 99% 正常运行时间 SLA 的保证容量,承诺与其它服务相比可降低高达 90% 的成本。该服务支持 MiniMax M3 和 GLM-5.2。
-
Together AI 为开放模型推出预留吞吐量
Together AI 推出了预留吞吐量(Provisioned Throughput)服务,该服务提供开源前沿模型的预留推理容量。该服务采用基于 token 的定价和 99% 的正常运行时间服务水平协议(SLA)。它旨在提供无服务器的简便性和保证的容量,同时成本显著低于 Opus 4.8 等现有解决方案,并初步支持 MiniMax M3 和 GLM-5.2 等模型。
-
Together AI 为开放模型推出预留推理容量
Together AI 推出了预留吞吐量(Provisioned Throughput)服务,该服务提供开放权重 AI 模型的预留推理容量。此服务提供基于 token 的定价,并有 99% 的正常运行时间服务水平协议(SLA),旨在提供专有模型的可预测性以及开源替代方案的成本效益。预留吞吐量最初支持 MiniMax M3 和 GLM-5.2,旨在显著降低推理成本,与 Claude Opus 4.8 等模型相比,成本可能降低高达 90%。