实体
bigpickle
bigpickle
PulseAugur coverage of bigpickle — every cluster mentioning bigpickle across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
新的“WOOFER”指标揭示了令人惊讶的 LLM 性能得分
一位用户开发了一个“WOOFER”指标,使用“Probe_prompt”来评估大型语言模型 (LLM) 的性能。该指标产生了一些令人惊讶的结果,一些模型的得分出人意料地低,例如 # bigpickle 得分为 25,而一组小型模型(LFM2、Gemma3 (2B)、Llama32 和 Quen25)的共识得分仅为 18。值得注意的是,# Claude # Opus 评估自己的回应是天才,而较新的 # Nvidia 模型 nematro…
-
Claude 模型成本下降,免费 AI 计算获得关注
一位 Mastodon 用户分享了他们 V3 harness orchestrator 的鼓舞人心的结果,并指出与 Claude 模型相关的成本显著下降。该用户强调,像 bigpickle 和 llama 这样的免费模型现在处理着他们 80% 以上的任务计算,并表达了希望这种利用免费计算资源的趋势能够持续下去。