研究人员推出 Jina-OCR-v1,这是一款专为在低预算 GPU 上高效运行而设计的新型文档解析模型。该模型集成了 DeepSeek-OCR 架构和 FastMTP 推测解码头,该解码头递归共享草稿块以加速预测。Jina-OCR-v1 在 OmniDocBench v1.6 和 olmOCR-Bench 等基准测试中取得了高分,并在 NVIDIA L4 等硬件上展示了比传统解码方法显著的速度提升。该模型的训练涉及指令对齐、鲁棒性微调以及一种使用密集可验证奖励进行确定性检查的新型 GRPO 方法。 AI
影响 该模型在低预算 GPU 上的效率可以普及先进的文档解析能力。
排序理由 该集群描述了在 arXiv 上发布的新模型发布和基准测试结果。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →