腾讯发布了 WeVisDoc,这是一款专为页面图像设计的端到端文档解析器。该模型基于 Qwen3-VL-2B-Instruct 和 Qwen3-VL-4B-Instruct 微调而来,可将页面图像转换为结构化 Markdown,包括 LaTeX 公式和 HTML 表格。WeVisDoc-4B 在 OmniDocBench 和 PureDocBench 等基准测试中表现出色,在多种场景下优于其他端到端解析器。 AI
影响 该工具可以改进文档处理和从图像文档中提取数据。
排序理由 这是来自一家大型科技公司的具体产品发布,但不是前沿模型发布。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →