研究人员开发了 MéTRON-FR,这是一个仅在法语文本上训练的 1.25 亿参数 GPT-2 模型,在法语特定基准测试中取得了显著分数。当使用跨语言 GLUE 协议进行评估时,该模型在关系任务上有所改进,但在世界知识任务上有所退步。研究还强调了分词器和提示模板在小规模模型性能上的显著影响,强调了对母语基准测试和敏感性分析的必要性。 AI
影响 强调了母语评估和分词器敏感性对于小型语言模型的重要性。
排序理由 学术论文,详细介绍了新模型和评估方法。 [lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →