一项比较 DocLang 和 Markdown 用于将 PDF 数据输入 LLM 的实验发现,当提供整个文档作为上下文时,两种格式都能产生相同的答案准确性。该研究使用了 15 页的 RFP 文档和 gpt-5.4-mini 模型。虽然答案准确性相同,但与 Markdown 相比,DocLang 的 token 使用量增加了 1.5 倍到 2 倍。 AI
影响 在提供完整上下文的 PDF 转 LLM 任务中,DocLang 相较于 Markdown 没有准确性优势,但会产生更高的 token 成本。
排序理由 对两种用于 LLM 输入的文档格式进行的比较研究。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →