Reddit r/MachineLearning 版块的一名用户正在寻求关于技术流程的建议,以将学术教科书图表转换为交互式和可编辑的数字资产。目标是检测图表,移除嵌入式标签同时保留艺术作品,并存储几何图形以供前端渲染。用户愿意接受人工辅助工作流程,并优先考虑低推理成本,倾向于传统的或轻量级的计算机视觉方法,而不是昂贵的多模态 LLM。他们正在寻找针对这一特定挑战的模型、数据集、开源项目和研究领域的建议。 AI
影响 不适用
排序理由 用户查询寻求特定问题的技术建议。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →