最近对 ChatGPT 代理模式(现称为 Work,由 GPT-5.6 提供支持)进行的为期 20 小时的测试显示结果好坏参半。虽然它在数据聚合和个性化消息等任务中显示出潜力,但在复杂步骤和验证码方面却举步维艰,有时会悄无声息地失败,或者比人类的表现慢得多。OpenAI 已将 Work 模式转为基于积分的系统,可能会引入新的使用限制,但这些限制尚未完全公开。 AI
影响 ChatGPT 代理模式在复杂、现实世界任务上的表现仍然是关键的改进领域,影响着用户信任和自动化潜力。
排序理由 该条目讨论的是现有产品(ChatGPT)的特定功能(代理模式)及其性能,而不是新的模型发布或基础研究。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →