一篇新研究论文提出了扩散大型多模态模型(LMM)中“两个时钟”的概念,区分了答案何时稳定以及其推理何时完全生成。该研究分析了在三个视觉问答基准上的这种现象,发现相当一部分推理在答案稳定时仍未写出。对不同块长度和提示策略(包括直接指令)的实验显示了对准确性和覆盖率的影响,表明覆盖率是提示差异的更大组成部分,而非条件准确性。 AI
影响 这项研究为 LMM 的内部时间动态提供了见解,可能指导未来模型开发以改进推理和答案生成。
排序理由 该集群包含一篇详细介绍扩散 LMM 内部工作原理的新颖发现的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →