一位Reddit用户正在就使用蒸馏LLM方法的文档提取过程寻求建议。他们训练了两个287M编码器模型,一个用于实体识别(GLiNER),另一个用于分类,以处理法院判决。用户详细介绍了他们的两步过程:首先,使用Claude Sonnet等强大LLM来标记一部分文档并提取实体、动作和值,然后,在这些标记数据上微调更小的模型。他们在匹配原始LLM的性能方面遇到了问题,并正在寻求对其方法的反馈。 AI
排序理由 用户正在就技术过程寻求建议,而不是宣布新产品或研究。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →