Prime Intellect 推出了 Prime Inference,一个专为前沿开源 AI 模型设计的新型推理平台。该平台利用 NVIDIA Blackwell GPU,提供用于应对可变需求的无服务器端点和用于持续工作负载的预留容量。Prime Inference 旨在通过结合 NVIDIA Dynamo、vLLM、Mooncake 和 FlashInfer 等技术来优化性能,并支持与 OpenAI 兼容的 API。 AI
影响 该平台可以为开发人员和企业简化开源 AI 模型的部署和扩展。
排序理由 这是一个面向开源模型的推理平台的产品发布,而不是来自主要实验室的前沿模型发布。
在 Mastodon — mastodon.social 阅读 →
- FlashInfer
- GB200 NVL72
- GLM 5.3
- Mooncake
- NVIDIA Blackwell B200
- NVIDIA Dynamo
- OpenAI
- OpenRouter
- Prime Inference
- Prime Intellect Novel
- SemiAnalysis AgentX
- vLLM
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →