一款名为 trace2train 的新开源工具已发布,可将失败的代理追踪转换为监督微调 (SFT) 或直接偏好优化 (DPO) 训练数据。该工具作为本地 CLI 工具开发,旨在利用代理错误(例如不正确的工具选择或错误的参数),这些错误通常会丢失在日志中,以改进模型。该工具支持 LangSmith 和 Langfuse 等各种追踪源,并可利用 DeepSeek 或 OpenAI 等模型进行处理,同时通过仅在可从追踪中推导出的情况下生成更正来优先考虑数据完整性。 AI
影响 通过利用先前丢弃的错误数据,实现更高效的 AI 代理微调。
排序理由 面向 AI 开发的新开源工具发布。
- DeepSeek
- Direct Preference Optimization
- Langfuse
- LangSmith
- LLaMA-Factory
- OpenAI
- supervised fine-tuning
- trace2train
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →