togethercompute
PulseAugur coverage of togethercompute — every cluster mentioning togethercompute across labs, papers, and developer communities, ranked by signal.
- 2026-07-02 research_milestone Together AI announced significant improvements in inference speed and cost reduction, alongside a commitment to weekly model releases. 来源
-
Together AI 预告即将发布公告,敦促用户参与
Together AI 宣布了新的发展,敦促用户保持通知开启以获取即将到来的更新。此次公告的具体性质仍未披露,但表明该公司即将发生重大事件或发布。
-
MiniMax AI 在巴黎 AI 活动上强调开放模型
MiniMax AI 参加了在巴黎举行的 RAISE 周活动,强调了开放模型在前沿人工智能发展中的日益增长的重要性。该公司总裁讨论了开放模型和多模态,同时 MiniMax 还与多家人工智能公司和基础设施合作伙伴举办了小组讨论和沙龙。这些活动侧重于开放模型在企业应用中的实际应用和扩展。
-
MiniMax AI将在RAISE Week举办高管聚会
MiniMax AI将参加RAISE Week,这是一个专注于前沿多模态AI的高管聚会。该公司将于7月9日举办一场私人活动,邀请TogetherCompute、Cast AI和Magnific AI的高管参加,共同探讨实际AI部署。此外,MiniMax AI团队将于7月8日至9日在Delorme的32D展位展出,欢迎与会者前来交流和分享他们的工作。
-
Together AI 实现成本降低 6 倍和低于 400 毫秒的延迟
Together AI 宣布了其推理能力的重大改进,实现了每次交互成本降低六倍和 p95 延迟低于 400 毫秒。该公司还致力于每周发布新模型,表明了快速的开发和部署周期。
-
Together 和 MiniMax AI 讨论 AI 优化
Together 和 MiniMax AI 正在联合举办一场讨论稀疏注意力和内核优化的谈话。此次活动在 X 上进行推广,旨在分享关于这些先进 AI 技术的见解。
-
Together AI 发布免费 Brrrrr 推理模型
Together AI 发布了 Brrrrr,这是一款可免费使用的新推理模型。早期基准测试显示,该模型每秒可处理 131 个 token。
-
Together AI 提供优化的 GLM-5.2 推理服务
Together AI 现已推出 GLM-5.2,据称该模型速度快,能够处理长上下文编码和代理工作负载。该公司强调其优化的服务基础设施,可在 OpenRouter 等平台上实现高吞吐量(TPS)。这一发展凸显了 Together AI 在高效推理方面的专注,以应对严苛的 AI 任务。