GPT-Live 1
PulseAugur coverage of GPT-Live 1 — every cluster mentioning GPT-Live 1 across labs, papers, and developer communities, ranked by signal.
- 2026-09-15 product_launch Dograh has launched GPT-Live-1, an open-source platform for voice agents. 来源
- 2026-09-12 product_launch KingLand has launched GPT-Live-1, a new AI model featuring full duplex communication capabilities. 来源
- 2026-09-11 product_launch OpenAI released the API for its new voice model, GPT-Live-1. 来源
- 2026-09-11 product_launch OpenAI released the API for its new voice conversation model, GPT-Live-1. 来源
- 2026-09-10 product_launch OpenAI released the GPT-Live-1 API, enabling full-duplex speech capabilities for developers. 来源
- 2026-09-10 product_launch OpenAI has launched GPT-Live-1, making it available through their API. 来源
- 2026-09-10 product_launch OpenAI has made GPT-Live-1 available via their API, enabling developers to integrate conversational voice agents into their applications. 来源
- 2026-09-10 product_launch OpenAI released GPT-Live 1 into its API, offering enhanced voice capabilities. 来源
- 2026-07-21 product_launch OpenAI released GPT-Live-1 and GPT-Live-1 mini, new full-duplex voice AI models. 来源
4 天有情绪数据
GPT-Live-1 API integration is gaining traction
Multiple clusters indicate OpenAI's release of GPT-Live-1 for API integration, with specific mentions of simultaneous listening and speaking capabilities. This suggests developers are actively exploring and adopting the technology for enhanced conversational AI applications.
OpenAI to release enterprise-focused GPT-Live-1 features within 30 days
Given the recent launch of GPT-Live-1 with advanced features like full-duplex communication and the Agents API beta, OpenAI is likely to announce enterprise-specific features or solutions to capitalize on this new infrastructure. This could include enhanced security, dedicated support, or specialized agent functionalities for business use cases.
Google's Gemini 3.8 Live positions itself as a cost-effective competitor to GPT-Live-1
The release of Google's Gemini 3.8 Live and Extended Thinking models explicitly mentions operating at a significantly lower cost compared to GPT-Live-1. This indicates a direct competitive strategy by Google, aiming to attract users seeking similar advanced multimodal capabilities at a more accessible price point.
GPT-Live-1 API adoption to exceed 1000 developers within 30 days
OpenAI has launched GPT-Live-1 with multiple API releases, indicating a strong push for developer adoption. The API offers significant improvements in voice interaction, including full-duplex capabilities and task delegation. Given the clear benefits and OpenAI's market position, rapid developer uptake is likely.
GPT-Live-1 API pricing at $0.05/min may indicate a premium service tier
The reported API price of $0.05 per minute for GPT-Live-1 suggests a potentially higher cost compared to standard text-based APIs. This could signify that GPT-Live-1 is positioned as a premium offering, targeting use cases that require advanced real-time voice interaction capabilities.
-
Google 发布 Gemini 3.8 Live 和 Extended Thinking 模型
Google 发布了两款新模型 Gemini 3.8 Live 和 Extended Thinking,它们提供先进的多模态功能。与竞争对手的 GPT-Live-1 模型相比,这些模型的运行成本显著降低。此次发布凸显了 Google 在开发和部署先进人工智能技术方面的持续努力。
-
Google推出更便宜的Gemini 3.8 Live以挑战OpenAI的GPT-Live-1
Google DeepMind 推出了 Gemini 3.8 Live 和 3.8 Live Extended Thinking,这是专为开发者设计的新音频模型。这些模型旨在通过提供每小时1.38美元的语音对话显著更低的价格点来与OpenAI的GPT-Live-1竞争。此举表明,AI模型成本降低的竞赛正在加速,可能超过基础设施的发展。
-
Instinct AI 代理评价不一;OpenAI 发布新 API,推迟 IPO
新的个人 AI 代理 Instinct 收到了褒贬不一的评价,有用户发现它运行缓慢,感觉像是在施加一种老板式的动态。关于这些代理会记住用户哪些信息的透明度问题也引起了担忧。与此同时,OpenAI 宣布了新的 API 产品,包括为 ChatGPT 语音模式提供支持的模型 GPT-Live-1,以及用于托管代理部署的 Agents API。该公司还计划至少将 IPO 推迟到 2026 年,因为在 AI 对齐、控制和安全方面的工作仍在进行中。
-
Dograh 发布 GPT-Live-1 语音代理平台,后端采用 GPT-6 Astra
Dograh 推出了 GPT-Live-1,一个开源的语音代理平台。该系统采用 GPT-6 Astra 作为其后端,性能提升了 30%,尽管该分数反映了两个组件的综合性能。GPT-Live-1 可与用户现有的推理模型集成,无论是自托管、微调还是来自其他提供商的模型,允许用户使用自己的 API 密钥。
-
OpenAI的GPT-Live-1支持实时全双工通信
OpenAI推出了GPT-Live-1,这是一款采用全双工模式的新模型。这项进步允许应用程序同时收听和说话,无需等待机器人完成响应。新功能旨在创造更自然、更高效的人工智能交互。
-
KingLand发布GPT-Live-1,实现全双工AI通信
KingLand发布了GPT-Live-1,这是一款提供全双工通信的新AI模型。这项进展旨在通过实现语音和文本的同时处理来改善交互。该模型与OpenAI相关,被认为是AI和大语言模型领域的一项重要发展。
-
JavaScript和Cookie等Web基础知识对于访问AI仍然至关重要
一条Mastodon帖子幽默地指出,在2023年,JavaScript和Cookie等基本Web功能对于访问AI进步仍然是必不可少的。该帖子讽刺地暗示,启用这些功能就像发现了如何给电脑插电一样,并链接到OpenAI关于GPT-Live 1的公告。
-
OpenAI 发布 Agents API Beta 版和 GPT-Live-1 以增强 AI 交互
OpenAI 已在其公测版中发布了 Agents API,利用 Codex 的基础设施来支持创建基于云的代理。此外,该公司现在通过其 API 提供 GPT-Live-1,这是一个旨在处理语音交互中断和请求变更的模型。这些发布旨在增强 AI 交互的能力和灵活性。
-
OpenAI发布GPT-Live-1 API,支持实时语音对话
OpenAI发布了其新型语音对话模型GPT-Live-1的API,使开发者能够创建更自然、更可控的语音体验。该模型采用全双工通信方式,能够同时进行倾听和说话,这与之前的顺序模型不同。GPT-Live-1还改进了对背景噪音的处理能力,能够将复杂任务委托给其他模型,并支持自定义语音特征,如音调、语速和风格。
-
OpenAI 发布 GPT-Live 1 API 支持实时语音对话 · 追踪 4 个来源
OpenAI 发布了 GPT-Live 1,这是一个新的开发者 API,能够实现与 AI 模型进行更流畅、更具交互性的语音对话。该全双工语音模型在测试中达到了 80.1% 的交互性得分,相较于前代产品有了显著提升。该 API 的定价为每分钟 0.05 美元。
-
OpenAI发布GPT-Live-1以供API集成
OpenAI已发布GPT-Live-1,并通过其API提供。这项新功能允许开发人员将ChatGPT的对话能力(包括可以同时听和说的语音代理)集成到他们的应用程序中。语音代理旨在与开发人员选择的各种模型和工具协同工作。
-
OpenAI 的 GPT-Live 1 提供自然语音,但在遵循指令方面存在不足
OpenAI 已在其 API 中发布了 GPT-Live 1,旨在通过全双工对话和自定义语音功能增强语音体验。虽然该模型提供听起来自然的音频和无缝的轮流对话,但早期用户报告在遵循指令、字面解释提示以及偶尔的字母数字发音错误方面存在严重问题。该模型在不同语言中也表现出不一致的口音。
-
ChatGPT、Gemini 和 Alice 语音模式在俄罗斯用户中的比较
OpenAI 推出了 GPT-Live,作为 ChatGPT 语音模式的全双工替代品,提供了改进的指令遵循和工具使用能力。然而,由于 VPN 屏蔽和支付问题,在俄罗斯的访问受到严重限制。Google 的 Gemini 3.1 Flash Live 也具备实时多语言能力,目前仅通过 API 对开发者开放。Yandex 的 Alice AI 发布了免费的 Live 模式,为视障用户提供实时物体识别功能,但仅在俄罗斯和白俄罗斯可用,并且不明…
-
ChatGPT推出GPT-Live,实现更自然的语音对话
OpenAI为ChatGPT推出了新的GPT-Live模型,通过更自然的全双工架构增强语音对话能力,允许同时进行听和说。此次升级已在Android、iOS和网页浏览器上推出,旨在减少以往语音交互中常见的尴尬停顿和中断。付费订阅用户将可以使用GPT-Live-1模型,而免费用户将获得GPT-Live-1 mini,并可选择调整AI的响应智能。
-
OpenAI 增强 ChatGPT 语音功能,实现实时聆听和更快响应
OpenAI 通过重建其语音堆栈,增强了 ChatGPT 语音功能,使其能够进行更自然、更快速的对话。新架构允许系统在说话时进行聆听,通过专用快速通道处理音频以获得即时响应。更深层次的推理和工具使用是异步处理的,确保对话流畅不中断,并将启动时间从六次网络往返减少到一次。
-
OpenAI 发布 GPT-Live-1,实现同步收听和说话
OpenAI 发布了 GPT-Live-1 和 GPT-Live-1 mini,这是两款新的全双工语音 AI 模型,能够同时收听和说话,模仿人类对话的流程。这些模型取代了之前的 Advanced Voice Mode,并正在通过包括移动和车载系统在内的各种平台向全球推出。新技术允许打断、插话和更自然的对话节奏,旨在超越 Siri 和 Amazon Alexa 等现有语音助手。
-
OpenAI的GPT-Live-1语音模型因每日限制过低引发用户抱怨
用户正在讨论OpenAI新GPT-Live-1语音模型的每日使用限制。虽然有些人询问Pro套餐是否提供无限次使用,但其他人遇到了低限制,即使是Plus订阅用户也只能使用30分钟到1小时。尽管此次升级令人印象深刻,但限制性的使用上限让用户感到失望。
-
SpaceXAI 与 Cursor 合作推出 Grok 4.5,目标是处理复杂任务并提高代币效率 · 追踪 2 个来源
SpaceXAI 已推出 Grok 4.5,这是与 Cursor 合作开发的新型 AI 模型,旨在处理包括软件工程、法律和金融服务在内的各个领域的复杂、长期任务。该模型在代币效率方面取得了显著改进,据报道,在 SWE Bench Pro 上,其输出代币数量比 Anthropic 的 Opus 4.8 少约 4.2 倍。Grok 4.5 在 Harvey 的法律代理基准测试中也获得了最高排名,定价为每百万输入代币 2 美元,每百万输出代…
-
OpenAI 通过 GPT-Live 增强 ChatGPT 语音功能,Google 推出 Video Remix
OpenAI 推出了 GPT-Live,这是旨在增强 ChatGPT 中自然人机交互的新一代语音模型。此次升级旨在使对话更加流畅,让 AI 能够同时进行倾听、说话甚至在线研究,从而减少中断,使交互感觉更像人类。此外,Google 正在为其 AI 订阅用户推出“Video Remix”功能,允许用户使用 Gemini Omni 在 Google Photos 中重新构想视频。
-
OpenAI 的 ChatGPT 通过 GPT-Live 实现实时语音,改善对话流程
OpenAI 推出了 GPT-Live,这是 ChatGPT 的一项新语音模型,支持同时听和说,从而实现更自然的对话。这种全双工架构允许模型在用户仍在说话时做出响应,并将复杂查询委托给 GPT-5.5 等模型以提高响应质量。GPT-Live-1 可供付费 ChatGPT 用户使用,免费账户用户可以使用一个较小版本,API 访问即将推出。此次更新还包括增强的安全功能以及为某些主题生成视觉辅助工具的能力。