Transformer Reinforcement Learning (TRL) 库发布了1.13.0版本,引入了训练上下文超过100万token模型的能力。此次更新包含了一个指南和一个实际示例,演示了如何在单步中训练书籍长度的序列。 AI
影响 支持在显著更大的上下文上训练模型,可能提高需要长距离理解的任务的性能。
排序理由 包含新功能的软件库发布。
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →