一位开发者发现 Clawdmeter 应用程序在跟踪 Claude Code 使用量时存在严重的计数过高问题。该开发者的审计使用该应用程序自己的代码和一个合成语料库,发现令牌计数比实际高约 2.34 倍。Clawdmeter 的维护者确认了该错误,并在三天内发布了修复程序,在发布说明中承认了计数过高的问题。值得注意的是,维护者使用他自己的工具和语料库独立验证了该问题,而不是直接运行审计员的测试套件,审计员认为这是对调查结果的有力确认。 AI
影响 凸显了第三方 LLM 使用工具中令牌计数可能不准确的问题。
排序理由 该条目描述了跟踪 LLM 使用情况的特定应用程序中的一个错误修复,而不是核心 AI 模型发布或研究。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →