一篇新发表在arXiv上的论文介绍了一种通过将大语言模型(LLM)的token嵌入建模为动态系统来区分LLM的理论保证。该研究将此分类任务形式化为一个二元假设检验,证明了准确率的下限受限于系统平稳边际分布的总变异距离。论文还表明,误分类概率随序列长度呈指数级下降,由一个称为动态可辨识性的量决定,并提供了一个理解跨嵌入泛化的框架。 AI
影响 为分析LLM行为提供了理论基础,可能带来更鲁棒的模型差异评估和理解。
排序理由 该聚类包含一篇发表在arXiv上的研究论文,详细介绍了对LLM token生成的理论分析。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- CatalyzeX
- computer science
- DagsHub
- dynamical system
- Gotit.pub
- Hugging Face
- IArxiv
- large language models
- machine learning
- ScienceCast
- Token Generation
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →