Together AI 正在展示代理工作负载的强劲性能,服务于 GLM 5.3 和 GLM 5.3 Flash 模型。根据 OpenRouter 的数据,Together AI 的模型在每秒事务数、延迟和缓存命中率等指标上表现处于前 10% 的水平。这些性能是在显著的流量下实现的,分别占 OpenRouter 平台上所有 GLM 5.3 和 GLM 5.3 Flash 流量的 23% 和 30%。 AI
影响 展示了代理工作负载的竞争性性能,可能会影响使用推理平台的开发者的选择。
排序理由 这是来自第三方平台的关于一家公司模型的性能报告,而不是来自前沿实验室的直接发布。
在 X — Together (inference / OSS) 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →