PulseAugur
实时 14:35:18
实体 Ai Gateway

Ai Gateway

PulseAugur coverage of Ai Gateway — every cluster mentioning Ai Gateway across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
22
90 天内 45
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
关系
时间线
  1. 2026-08-11 product_launch Ngrok launched its AI Gateway product on Product Hunt, offering a unified endpoint for accessing various LLM providers. 来源
  2. 2026-07-29 product_launch AI Gateway has launched a new unified fast mode for all supported models, offering lower latency and higher throughput at an increased cost. 来源
  3. 2026-07-28 product_launch Vercel's AI Gateway now allows users to pin inference requests to US or EU regions. 来源
  4. 2026-07-27 product_launch AI Gateway has added WebSocket support for the OpenAI Responses API, enabling persistent connections for multi-turn agent workflows. 来源
  5. 2026-07-22 product_launch AI Gateway launched streaming transcription capabilities for real-time audio-to-text conversion. 来源
  6. 2026-07-22 product_launch AI Gateway launched new service tiers for optimizing OpenAI and Gemini model performance and cost. 来源
情绪 · 30 天

13 天有情绪数据

最近 · 第 1/3 页 · 共 45 条
  1. FRONTIER RELEASE · CL_213188 ·

    DeepSeek 发布实验性视觉模型,在代理基准测试中可与 Opus 4.8 相媲美

    DeepSeek 推出了实验性多模态人工智能模型 V4-Flash-Vision-Exp,该模型将图像理解能力与其现有的文本处理能力相结合。该新模型在特定代理基准测试中的表现可与 Anthropic 的 Opus 4.8 相媲美,在某些情况下甚至超越了它。V4-Flash-Vision-Exp 的一个关键特性是其成本效益,以与其仅文本版本相同お价格提供先进的视觉功能。

  2. TOOL · CL_211593 ·

    GitLab 为 Dedicated 客户增强 AI Gateway 部署;OpenAI 推出 AI Futures 博客

    GitLab 已为其 Dedicated 客户在其单租户 SaaS 基础设施内部署 AI Gateway 以支持 GitLab Duo Agent Platform。这使得 AI 处理的数据能够保留在客户的环境和选定的区域内,GitLab Dedicated 由 GitLab 托管并提供每月 99.9% 的可用性。另外,OpenAI 推出了一个名为 AI Futures 的新博客,该博客将深入探讨变革性 AI 对权力结构、治理、经济和…

  3. SIGNIFICANT · CL_205134 ·

    OpenAI 将 GPT 5.6 Sol 价格全线下调 50%

    OpenAI 宣布将其 GPT 5.6 "Sol" 模型的价格大幅下调 50%,该模型可通过 OpenRouter 和 Vercel 的 AI Gateway 等平台使用。此次降价将输出代币成本从每百万美元 30 美元降至 15 美元,为期有限,部分促销活动将持续到 9 月 18 日。一些人认为此举是旨在提高采用率并可能影响与 Anthropic 等竞争对手的市场份额认知的战略营销举措。

  4. TOOL · CL_200685 ·

    AI 网关简化了开发者的 LLM 路由

    构建和维护自定义 LLM 路由是复杂的底层工作,会分散大多数开发团队的核心产品注意力。随着模型、定价和可用性的不断变化,路由需要持续维护。应用程序团队应利用预构建的 AI 网关来抽象化这种复杂性,而不是自己构建,从而使开发人员能够专注于产品创新。这些网关还可以集成工具使用,为访问模型和工具提供统一的接口。

  5. SIGNIFICANT · CL_204308 ·

    OpenAI 暂停前沿模型训练,新开源模型和智能体框架涌现

    发布了多个新的开源模型,包括不同尺寸和变体的 Ornith-1.5,以及在编码和智能体任务上表现强劲的 Qwen3.8-27B。这些发布伴随着模型压缩技术的进步,新的方法声称提高了准确性并降低了内存需求。智能体框架的格局也在不断发展,DeepSeek Harness 和 TrueFoundry 等平台将其系统开源,强调生产环境中智能体的模块化、可扩展性和成本效益。据报道,OpenAI 已暂停部分前沿模型训练,以加强安全和对齐控制,这表…

  6. TOOL · CL_195605 ·

    DeepSeek 在 AI Gateway 上的处理量超越 Google,Anthropic 在支出份额上领先

    DeepSeek 在 AI Gateway 上处理的 token 量已超过 Google,7 月份价格下降了 13.6%。与此同时,Anthropic 获得了显著的市场份额,尽管只处理了 30% 的流量,却占了 65% 的支出,其价格点也高得多。

  7. TOOL · CL_194331 ·

    Ngrok AI Gateway 利用隧道专业知识简化 LLM 路由

    Ngrok 推出了 AI Gateway 产品,旨在为开发人员简化 LLM 路由。该网关充当访问各种 AI 模型、管理 API 密钥和提供可观察性的统一端点。与许多竞争对手不同,Ngrok 的产品利用了其在网络隧道和暴露本地端口方面十年的专业知识,AI Gateway 是其先前内部工具的改进版本。

  8. TOOL · CL_188894 ·

    Cloudflare 发布 AI 工具,统一 AI 服务,并研究代理互联网

    Cloudflare 推出了名为 Radar Researcher 的新 AI 工具,旨在允许用户使用自然语言查询来探索互联网数据。该工具是 Cloudflare 将 AI 功能集成到其服务中的更广泛努力的一部分,包括将其 Workers AI 和 AI Gateway 统一为单一 AI 控制平面。该公司还在研究代理互联网上出现的积极和消极行为。

  9. TOOL · CL_181915 ·

    Cloudflare 部署 AI 代理以强制执行工程标准并简化工作流 · 跟踪 6 个来源

    Cloudflare 正在通过将 AI 代理集成到其开发生命周期中来加强其工程实践。这些由 Cloudflare Codex(工程指南的中央存储库)驱动的代理,已经标记了近二十五万个偏离标准的行为,并阻止了超过 16,000 次代码合并。该公司还在统一其 AI 产品,将 Workers AI 和 AI Gateway 合并到一个控制平面中,以简化模型路由、可观察性和安全性。此外,Cloudflare 推出了 Cloudflare OS…

  10. TOOL · CL_180263 ·

    阿里巴巴的 Qwen 3.8 Max 提供低成本、高性能的 AI 访问

    阿里巴巴的 Qwen 3.8 Max 模型现已通过 AI Gateway 提供访问,在性能和成本方面提供了有竞争力的平衡。虽然它在 DeepsecBench 网络安全排行榜上的表现一般,但其较低的运营成本使其成为一个有吸引力的选择。像 Qwen 3.8 Max 这样的模型的可用性被认为是降低其他大型语言模型定价的关键驱动因素。

  11. TOOL · CL_175744 ·

    Laguna S 2.1 将 AI Gateway 容量提升十倍

    Laguna S 2.1 是 AI Gateway 上的一款 AI 模型,其免费和付费套餐的容量均显著增加了 10 倍。此次增强支持更大的请求量,尤其有利于代理编码和长任务的处理。

  12. TOOL · CL_174625 ·

    MCP 2.0、AI 模型降价以及关键 Rails/Nuxt 安全补丁发布

    本周多个技术领域都有重要更新,包括 MCP 协议、AI 模型定价以及 Web 开发框架。MCP 处理程序已更新至 2.0 版本,引入了无状态协议支持,这对于无服务器部署尤其有利。在 AI 领域,模型提供商将 GPT 5.6 Luna 的 token 成本降低了 80%,并将 Sol 的快速模式速度提高了 2.5 倍,这些改进已自动反映在 AI Gateway 中。此外,ThinkingMachines 发布了其 Inkling 模型的…

  13. TOOL · CL_173696 ·

    Thinking Machines 的 Inkling Small 模型已集成到 AI Gateway

    Thinking Machines 的 Inkling Small 模型现已在 AI Gateway 上可用。该模型以其更小的体积而闻名,性能可与其大型版本相媲美,而体积仅为其四分之一。它具有原生音频和图像推理能力,以及可控的思考强度和零数据保留,使其适用于编码和工具使用任务。

  14. TOOL · CL_171437 ·

    AI Gateway为所有模型新增统一快速模式

    AI Gateway已在所有支持的模型中引入了统一的快速模式。此功能允许用户选择更快的速度以降低延迟或提高吞吐量,但成本也会更高。该系统还包含一个自动回退机制。

  15. TOOL · CL_166703 ·

    Vercel AI Gateway 为推理请求添加区域固定功能

    Vercel 的 AI Gateway 推出了一项新功能,允许用户指定其推理请求是在美国还是欧盟区域进行处理。此增强功能旨在提供对数据位置的更大控制,并通过将请求路由到地理上更近的服务器来潜在地提高延迟。该网关还负责跨提供商的路由和响应确认。

  16. TOOL · CL_166502 ·

    AI Gateway 通过 WebSocket 支持为代理提升 OpenAI API 速度

    AI Gateway 已为 OpenAI Responses API 集成了 WebSocket 支持,该支持允许持久连接。据 OpenAI 称,这一增强功能旨在促进多轮代理工作流,并已在涉及超过 20 次工具调用的代理部署中将执行速度提高了高达 40%。

  17. TOOL · CL_165341 ·

    AI网关整合LLM访问、安全和成本控制 · 跟踪4个来源

    AI网关正成为管理LLM交互的关键中间件,集中处理路由、安全和成本控制。这些平台旨在通过为不同的LLM提供商提供统一的API来简化开发,从而实现更轻松的模型切换并防止供应商锁定。关键评估标准包括治理范围、安全功能、可观测性、访问控制和部署灵活性,选项范围从基础设施优先的扩展到LLM原生解决方案。

  18. TOOL · CL_165287 ·

    Bifröst AI 网关在性能基准测试中优于 LiteLLM

    一项对两个开源 AI 网关 Bifröst 和 LiteLLM 的基准测试发现,Bifröst 在负载较高的情况下,性能显著更优,开销更低。虽然 Bifröst 在非流式测试中显示出 6.2 倍的吞吐量优势和极低的延迟增加,但 LiteLLM 提供了对各种 LLM 提供商和端点的更广泛支持。两者的选择取决于是在应用程序中还是在网关中偏好复杂性。

  19. SIGNIFICANT · CL_162077 ·

    蚂蚁集团 inclusionAI 发布 Ling-3.0-flash,支持256K上下文 · 已追踪2个来源

    inclusionAI,蚂蚁集团的一项计划,发布了 Ling-3.0-flash,一个拥有1240亿参数的混合专家模型。该模型拥有256,000个token的上下文窗口,专为高效的代理任务和长上下文工作流而设计。Ling-3.0-flash 目前可通过 OpenRouter 和 Vercel 的 AI Gateway API 访问,并提供至8月3日的免费访问。

  20. FRONTIER RELEASE · CL_162098 ·

    Anthropic 的 Claude Opus 5 优先考虑效率而非原始性能

    Anthropic 发布了 Claude Opus 5,该模型专注于提高代币效率和降低成本,而不是在原始性能上取得重大飞跃。虽然 Opus 5 的总体表现优于其前身 Opus 4.8,但它表现出一些类似于 'Fable' 模型的古怪语言行为。新模型提供五种努力设置,并建议用户 'max' 设置并非适用于所有任务,尤其是在编码方面,这可能导致分数下降。