Sol 5.6
PulseAugur coverage of Sol 5.6 — every cluster mentioning Sol 5.6 across labs, papers, and developer communities, ranked by signal.
3 天有情绪数据
-
OpenAI 的 Sol 5.6 模型出现性能突然下降
OpenAI 的 Sol 5.6 模型用户报告称,其性能突然且显著下降,响应变得随机、无关且“愚蠢”。这个问题似乎影响了多位用户,因为原帖子的几位朋友也观察到该模型在过去几个小时内的能力有所下降。
-
新基准使用“马骑自行车”提示词测试大语言模型 · 跟踪到2个来源
发布了一个新的基准测试,旨在取代旧的、不太相关的测试。该基准测试使用一个包含“马骑自行车,背景有骆驼”的提示词来评估各种语言模型。尽管提示词有拼写错误,但仍被用来比较 Qwen3.8-27b、Sol 5.6 和 Qwen3.6-35B 等模型。
-
用户偏爱昂贵的“fable”AI模型,因其清晰度和准确性
一位Reddit用户分享了他们使用各种AI模型的经验,发现“fable”在处理复杂任务时始终能提供最清晰、最准确的答案。尽管成本高昂,但他们在关键需求上仍偏爱“fable”,约15%的查询使用它。他们还提到,大部分任务使用SOL 5.6,一小部分使用Grok 4.5,而ChatGPT Pro则提供了最佳的性价比。
-
用户对 Claude MAX Opus 4.8 感到沮丧,寻求与 Sol 5.6 的比较
一位 Reddit 用户对 Anthropic 的 Claude MAX Opus 模型(特别是 4.8 版本)表示沮丧,认为它过于冗长和效率低下。他们正在寻求 Claude MAX Opus 4.8 与一个称为 Sol 5.6 的模型之间的比较,因为当前版本正在阻碍他们管理多个并发上下文窗口的工作流程,而这需要速度和简洁性。
-
用户抨击AI的3D能力“无用”且“垃圾”
一位Reddit用户对当前AI的能力,尤其是在3D工作和创意任务方面,表达了极大的沮丧。他们发现像Opus 5和Sol 5.6这样的模型在纹理生成和网格处理方面效果不佳,尽管提供了大量的上下文和参考。该用户还批评AI在Substance Painter等软件上的建议毫无帮助,其代码重写能力产生的输出也毫无意义。他们认为AI被过度炒作,距离真正用于复杂的现实世界应用还有很多年,只有在编码方面它才显示出一些用处。
-
ClaudeAI 用户报告 Fable 发布后出现显著缓慢
一位长期订阅 Anthropic 每月 200 美元 Claude 套餐的用户报告称,在过去一个月内,该模型的速度显著下降,这与 Fable 模型的发布时间吻合。这位用户之前发现 Claude 对其咨询业务效率很高,但现在却遇到了极端的缓慢问题,完成某些任务需要数小时,而 Sol 5.6 等其他模型则能更快地完成。尽管已实施 Anthropic 推荐的速度优化措施,但问题依然存在,导致用户考虑转向其他模型。
-
用户发现Anthropic的Fable 5在复杂任务上优于OpenAI的Codex
一位用户发现,与Anthropic的Fable 5模型相比,OpenAI的Codex(文中称为Sol 5.6)在其特定工作流程中效率显著较低且成本更高。用户报告称,Codex消耗积分的速度比他们的Claude Pro订阅快十倍,并且即使提供了全部上下文,也无法理解复杂的职位详情。因此,他们恢复使用Fable 5,并表示依赖其功能,同时寻求降低成本的方法。
-
OpenAI 的 Sol 5.6 性能超越 Anthropic 的 Opus 和 Fable 模型
一位用户报告称,OpenAI 的 Codex 5.6 Sol 在解决一个复杂的产品问题上,其性能显著优于 Anthropic 的 Opus 4.8 和 Fable 5,仅用两小时就解决了问题,而 Anthropic 的模型则花费了数周时间。用户对 Anthropic 最新的前沿模型表示失望,认为其可靠性和性能受限,可能由于计算能力限制和大量量化。这次经历导致用户取消了 Anthropic 的订阅,并称赞 OpenAI 提供的产品具有竞争力。
-
AI 模型 Feble 5 尝试通过高杠杆加密货币交易将 80 美元变成 5000 美元
一位用户正在测试名为 Feble 5 的 AI 模型的能力,为其提供了一个 80 美元的加密货币账户,目标是在 Sol 5.6 发布前达到 5000 美元。该 AI 在严格指示下,进行最大杠杆的全仓操作,在第一天已经进行了超过 10,000 次交易,展示了惊人的速度和盈利策略,且单笔交易亏损极少。用户计划在类似的实验中将 Feble 5 的表现与 Sol 5.6 进行比较。