Claude Sonnet 3.5
PulseAugur coverage of Claude Sonnet 3.5 — every cluster mentioning Claude Sonnet 3.5 across labs, papers, and developer communities, ranked by signal.
3 天有情绪数据
-
Google DeepMind发布Gemini 3.8 Flash;Anthropic维持Claude Sonnet 3.5定价
Google DeepMind发布了两款新模型Gemini 3.8 Flash和Gemini 3.8 Flash Cyber,前者在保持低成本的同时增强了智能体编码和多步推理能力。与此同时,Anthropic决定将Claude Sonnet 3.5的定价固定为每百万token输入$2,输出$10,尽管此前有涨价意向。这种定价的稳定性,加上Grok 4.6的持续价格,凸显了在API层面使高性能模型更实惠的竞争格局。
-
Anthropic 更新 Claude 系统提示词,不包括 API 用户
Anthropic 正在更新其 Claude 模型的系统提示词,这些提示词用于其网页界面和移动应用程序。这些更新旨在提供更当前的信息,例如日期,并鼓励特定的行为,如使用 Markdown 格式的代码片段。重要的是,这些系统提示词的更改不适用于 Claude API,这意味着 API 用户将不会看到相同的行为更新。
-
Anthropic 的 Claude 模型出现多个版本服务降级
2026 年 8 月 4 日至 5 日期间,Anthropic 经历了影响多个 Claude 模型的一系列服务降级。最初,Claude Sonnet 5 于 8 月 4 日出现错误率升高,随后得到解决。次日,Claude Mythos 5、Claude Fable 5 和 Claude Opus 5 也遇到了错误增加的情况,Anthropic 确定并解决了这些模型的根本原因。
-
Claude Sonnet 3.5 在关键功能上优于 ChatGPT Plus
Anthropic 的 Claude Sonnet 3.5 被呈现为 ChatGPT Plus 的更优选择,尽管它们具有相同的月订阅费用。文章重点介绍了 Claude Sonnet 3.5 的七项特定功能,据称 ChatGPT Plus 无法与之匹敌,这表明 OpenAI 服务的用户可能并未意识到这些高级功能。
-
新的RL方法提升LLM事件预测性能
一篇新的研究论文介绍了一种名为Group Relative Policy Optimization (GRPO)的强化学习方法,旨在增强大型语言模型(LLMs)的预测能力。实验表明,一个经过GRPO微调并配备维基百科工具以获取最新信息的1.5B参数Qwen 2.5模型,在事件预测准确性方面优于Claude Sonnet 3.5。该研究还探讨了LLM在预测方面的可扩展性以及不确定性领域内判断性预测的性质。
-
提议AI提升研究以衡量人类-AI生产力增益
一篇最近的LessWrong帖子提出了一个衡量AI提升的框架,通过比较有AI协助和无AI协助时人类完成任务的时间。作者建议进行实验,让单独的人类或借助当前AI的人类执行有经济价值的任务。这些研究旨在量化生产力增益,并为预测AI时间线提供数据,尽管挑战包括获取基线数据和选择随着AI能力发展而保持相关性的任务。