DeepInfra
PulseAugur coverage of DeepInfra — every cluster mentioning DeepInfra across labs, papers, and developer communities, ranked by signal.
8 天有情绪数据
-
TokenPAPA 提供比 DeepInfra 更广泛的中文 LLM 访问
TokenPAPA 和 DeepInfra 提供经济高效的 LLM API 访问,但在模型覆盖范围和目标受众方面有所不同。DeepInfra 在以低廉的价格提供 Llama 和 Mistral AI 等广泛的开源西方模型方面表现出色,并提供简单的定价和自动扩展功能。TokenPAPA 则通过提供 DeepSeek V4、Qwen 3.7 和 Minimax M3 等独家中文模型,以及 GPT 5.6 Luna 和 Claude 等西方…
-
Hugging Face 聚焦多样化的AI工具和项目
Hugging Face 通过其博客展示了各种AI项目和工具。最近的帖子包括来自TII UAE的Falcon Perception、DeepInfra作为推理提供商的角色,以及Hcompany的AI浏览器合作伙伴HoloTab。此外,还展示了OpenAI的Web应用隐私过滤器、nunchaku的4位扩散推理集成到diffusers中,以及Baseten宣布成为Hugging Face推理提供商。
-
Kimi K3 访问成本对比:OpenRouter 最便宜,Moonshot/DeepInfra 适合缓存命中
对四个访问 Kimi K3 大语言模型的平台进行的比较显示,根据使用模式的不同,价格差异显著。OpenRouter 以每百万 token 2.60 美元/13 美元的价格成为最便宜的 API 选择,而 Moonshot AI 的直接 API 和 DeepInfra 为缓存命中提供了更低的价格,成本降低了 90%,降至每百万 token 约 0.30 美元。Ollama Cloud 采用 GPU 时间计费模式,每 token 成本不透明…
-
OpenRouter替代品:TokenPAPA在中文大模型方面领先,Groq在速度方面领先
多个平台提供了访问大语言模型的OpenRouter替代方案,各有优势。TokenPAPA因其以有竞争力的价格访问DeepSeek V4 Flash和Mimo V2.5等中文大模型,以及简化的注册流程而受到关注。DeepInfra被认为是开源模型经济实惠的选择,而Together AI则提供更全面但价格更高的全栈解决方案,包括微调。Groq凭借其LPU硬件专注于速度,适用于延迟敏感的应用,而Fireworks AI则提供了快速服务和微调能力的结合。
-
阿里巴巴的Qwen3.8-2.4T-A95B模型在多个平台上线
阿里巴巴的Qwen团队发布了其Qwen3.8-2.4T-A95B模型,这是一款拥有2.4万亿总参数和950亿激活参数的大型稀疏混合专家模型。该模型现已通过多个平台提供,包括DeepInfra、DigitalOcean Serverless Inference、Modal和Nebius Token Factory,合作伙伴强调开发者可即日使用。Qwen3.8-Max版本拥有100万个token的上下文窗口,非常适合长时程编码和复杂推理任务。
-
蚂蚁集团 Ling 3.0 Flash 模型发布,支持本地部署
蚂蚁集团 inclusionAI 推出的 Ling 3.0 Flash,一个拥有 124B 参数的混合专家模型,已获得 MIT 许可并在 Hugging Face 上发布。该模型专为本地运行而设计,由于其每个 token 只激活 5.1B 参数的架构,相比 Kimi K3 等其他大模型,所需的内存显著减少。它支持长上下文的混合线性注意力,并默认支持推理,也可选择禁用推理以获得更快的响应。该模型可以在拥有 96GB 统一内存的 Mac …
-
Hugging Face 重点介绍新的推理提供商和 AI 工具 · 跟踪 4 个来源
Hugging Face 正在重点介绍几家正在增强其推理能力的公司和项目。DeepInfra 已被列为推理提供商,而 Hcompany 的 HoloTab 被介绍为 AI 浏览器合作伙伴。此外,Nunchaku 的 4 位扩散推理已集成到 diffusers 中,Baseten 也被宣布为该平台的推理提供商。
-
阿里巴巴发布Qwen3.8模型,增强编码和智能体能力 · 跟踪1个来源
阿里巴巴发布了其新的Qwen3.8大模型,在编程和智能体能力方面有了显著提升,使其跻身全球顶级模型之列。该模型支持100万token的上下文窗口和视觉理解,在编码和视觉基准测试中表现强劲。发布后,包括OpenRouter和Vercel在内的众多国际AI平台已集成Qwen3.8,从而促进了更广泛的开发者使用和在企业场景中的应用。阿里巴巴计划下周开源Qwen3.8-Max和Qwen3.8-27B,进一步扩大其已有的庞大开源模型生态系统。
-
Hugging Face 博客文章涵盖 AI 智能体、推理和批处理 · 跟踪 3 个来源
此集群汇总了来自 Mastodon 的三篇帖子,每篇都链接到一篇 Hugging Face 博客文章。第一篇帖子讨论了 Vakra 的内部工作原理,重点关注 IBM Research 详细介绍的智能体推理、工具使用和失败模式。第二篇帖子重点介绍了 DeepInfra 对 Hugging Face 推理提供商的看法。第三篇帖子探讨了在连续批处理中异步的使用。
-
苹果将与Klarna合作推出设备租赁服务“Apple Upgrade”
据报道,Apple 计划于7月28日推出一项名为“Apple Upgrade”的新设备租赁服务。该计划将涵盖 iPhone、Mac、iPad 和 Apple Watch 的各种型号,标志着 Apple 硬件销售策略的潜在转变。该公司预计将与金融科技公司 Klarna 合作,为该租赁计划提供融资。
-
Hugging Face 博客文章涵盖 Vakra AI、DeepInfra 和异步处理 · 跟踪 3 个来源
该集群重点介绍了 Hugging Face 的几篇技术博客文章,涵盖了各种 AI 主题。其中一篇深入探讨了 Vakra(一种 AI 智能体)的内部工作原理,检查了其推理、工具使用和失败模式。另一篇文章介绍了 DeepInfra 在 Hugging Face 平台上的推理提供者角色。最后,第三篇文章探讨了连续批处理中异步的复杂性。
-
Hugging Face博客文章涵盖AI代理内部机制、推理提供商和异步处理 · 跟踪3个来源
该集群重点介绍了来自Hugging Face的三个技术博客文章,每篇文章都侧重于AI基础设施和研究的不同方面。第一篇文章深入探讨了AI代理Vakra的内部工作原理,检查其推理、工具使用和故障模式。第二篇文章介绍了DeepInfra,讨论其在Hugging Face上作为推理提供商的角色。最后,第三篇文章探讨了连续批处理中异步处理的复杂性。
-
Cursor IDE 用户探索集成自定义 API 和模型
Reddit 的 r/cursor 子版块上一名用户正在询问是否可以将自己的 API(特别是通过 DeepInfra 驱动的 DeepSeek V4 Flash API)集成到 Cursor IDE 中。他们希望通过使用现有的模型访问权限来完成编码任务,从而避免 Cursor Pro 的额外订阅费用。
-
AI模型提供商:用户寻求GLM 5.2、DeepSeek V4的欧洲选项
Reddit 的 r/LocalLLaMA 社区的一名用户正在寻找运行开源大语言模型的欧洲提供商,特别提到了 GLM 5.2 和 DeepSeek V4 Flash。用户指出,虽然 OpenRouter 列出了 GLM 5.2 的众多提供商,但绝大多数位于美国,只有少数在亚洲,并对这些模型似乎缺乏欧洲选项表示惊讶。
-
Z.ai 发布 GLM-5.2,一款百万 token 的开源编码模型
Z.ai 发布了 GLM-5.2,这是一款专为编码和长时序代理任务设计的开源模型。该模型拥有百万 token 的上下文窗口,并提供高和最大两种推理模式。GLM-5.2 已被第三方迅速认可为领先的开源模型,在包括 FrontierSWE 和 Code Arena: Frontend 在内的各种编码和代理基准测试中均获得高排名。
-
Hugging Face 博客文章涵盖 AI 智能体、推理和处理
该集群重点介绍了 Hugging Face 的三篇博客文章,每篇文章都侧重于 AI 基础设施和研究的不同方面。第一篇文章深入探讨了 IBM Research 开发的 AI 智能体 Vakra 的内部工作原理,分析了其推理、工具使用和失败模式。第二篇文章介绍了 DeepInfra 作为 Hugging Face 上推理提供商的角色。第三篇文章探讨了连续批处理中异步的复杂性。
-
Moonshot AI 的 Kimi K2.6 编码模型在 SWE-Bench 上超越 GPT-5.4
Moonshot AI 发布了 Kimi K2.6,这是一个拥有 1 万亿参数的开放权重编码模型,在 SWE-Bench Pro 基准测试中表现优于 GPT-5.4。该模型专为代理任务设计,支持 262,144 个 token 的上下文窗口,并具备多模态能力,包括文本、图像,并即将支持视频。Kimi K2.6 在修改后的 MIT 许可下提供,该许可允许在一定阈值内的商业用途,使其成为与许可限制更严格的其他模型相比,企业的一个有竞争力的选择。
-
Hugging Face博客详细介绍VAKRA、DeepInfra和异步处理方面的AI研究
Hugging Face的三个独立博客文章讨论了AI研究和基础设施方面的进展。其中一篇文章深入探讨了VAKRA的内部工作原理,VAKRA是一个专注于智能体推理和工具使用的AI基准测试。另一篇文章强调了DeepInfra作为Hugging Face平台上推理提供商的角色。第三篇文章探讨了连续批处理系统中异步处理的复杂性。
-
Hugging Face 集成 DeepInfra 以实现无服务器人工智能模型推理
Hugging Face 已将 DeepInfra 集成到其 Hub 中,作为新的无服务器推理提供商。此次合作使开发人员能够通过 Hugging Face 平台访问各种模型,包括 DeepSeek V4 和 Kimi-K2.6 等大型语言模型,并提供具有成本效益的定价。此次集成支持文本生成和对话式人工智能等多种任务,并计划很快扩展到图像和视频生成。开发人员可以通过 Hugging Face 的客户端 SDK 和代理工具使用 DeepI…