研究人员开发了 ChaosProbe,一种分析冻结 Transformer 模型内部结构的新颖方法。该技术使用确定性神经混沌启发式变换来创建基于响应的输入嵌入空间指纹。概念验证研究表明,ChaosProbe 可以成功识别模型家族以及 GPT-2、DistilGPT2、BERT-base-uncased 和 RoBERTa-base 等模型之间的关系。 AI
影响 提供了一种理解 Transformer 模型内部表示的新方法,可能有助于模型分析和开发。
排序理由 该集群包含一篇详细介绍 Transformer 模型分析新方法的论文。
- arXiv
- bert-base-uncased
- ChaosProbe
- distilgpt2
- GPT-2
- Hugging Face
- alphaXiv
- CatalyzeX
- DagsHub
- Gotit.pub
- IArxiv
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →