研究人员推出了一种新颖的、无需训练的方法——Context-Aware Cluster Decoding (CACD),旨在提高扩散多模态大语言模型 (dMLLM) 的连贯性并减少语义漂移。现有的解码方法常常因基于置信度的评分而失败,这种评分会忽略邻居支持,而块分区则限制了对语义锚点的访问。CACD 通过将邻居邻近度整合到评分中并保持对锚点的无块访问来解决这些问题,从而实现更具上下文相关性的标记选择。实验表明,CACD 在各种 dMLLM 和基准测试中,尤其是在较长输出的情况下,始终能提高质量并减少幻觉。 AI
影响 通过改进解码过程中的标记选择,提高了 dMLLM 的输出质量和连贯性,尤其是在较长生成内容方面。
排序理由 关于 dMLLM 新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- CatalyzeX
- Context-Aware Cluster Decoding
- DagsHub
- DMLLMs
- Gotit.pub
- Hugging Face
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →