实体
pelican benchmark
pelican benchmark
PulseAugur coverage of pelican benchmark — every cluster mentioning pelican benchmark across labs, papers, and developer communities, ranked by signal.
总计 · 30天
3
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 3 条
-
Meta AI发布Spark 1.2,使用Pelican基准测试跟踪改进
Meta AI发布了Spark 1.2,这是其模型系列的最新版本,建立在Spark 1.1及更早版本的基础上。Pelican基准测试被用来直观地展示这些模型版本之间的渐进式改进。此次发布延续了Meta AI跟踪和展示其AI模型进展的努力。
-
sqlite-utils 3.39.1 发布,包含向后移植的修复,并引用了 Claude Code 和 Kimi K3
Simon Willison 发布了 sqlite-utils 的 3.39.1 版本,其中包含了一个向后移植的修复,用于 table.delete_where(),该修复最初在 4.0 版本中。发布说明还引用了关于“Claude Code 团队的 Cat 和 Thariq 的炉边谈话”以及“Kimi K3,以及我们仍然可以从 pelican benchmark 中学到什么”的近期文章。
-
Simon Willison 推出 LLM 陈词滥调高亮器工具
Simon Willison 开发了一款可在浏览器中运行的“LLM 陈词滥调高亮器”工具。该工具可识别并高亮显示 AI 生成文本中常见的短语,例如“无 X,无 Y”结构和“sit with that”等表达。该高亮器提供可切换的模式检测、上下文感知的句子高亮,并显示模式计数和匹配列表,方便用户使用。