研究人员开发了 AutoThinkSQL,一个旨在优化 Text-to-SQL 模型的新框架,使其能够动态决定何时使用复杂推理(Chain-of-Thought)以及何时绕过它来处理简单查询。该方法将自动思考整合到监督微调(SFT)和直接偏好优化(DPO)过程中。当应用于 Qwen3-Coder-30B-A3B 模型时,AutoThinkSQL 在 Spider 和 BIRD 基准测试中表现出持续的改进,同时与始终采用 Chain-of-Thought 的模型相比,显著减少了输出 token 和延迟。 AI
影响 这项研究可能通过减少简单查询不必要的计算开销,从而实现更高效、更具成本效益的 Text-to-SQL 系统部署。
排序理由 该集群描述了一篇关于改进 Text-to-SQL 模型的新颖框架的最新研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
- arXiv
- AutoThinkSQL
- BIRD
- Direct Preference Optimization: Your Language Model is Secretly a Reward Model
- qwen3-coder:30B-A3B
- supervised fine-tuning
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →