一位用户展示了使用 Qwen 3.8 27B 模型开发的、可玩的《侠盗猎车手》风格游戏,该模型利用了其全部 128k 上下文窗口。性能指标显示,对于简短或独特的提示,基线生成速度为 36-40 tokens/s,在较长运行期间,典型持续速度范围为 50-72 tokens/s。峰值速度高达 197 tokens/s,这归功于 n-gram 缓存的使用,在生成重复内容时显著提高了效率。 AI
影响 展示了大上下文窗口模型在游戏开发和复杂提示执行方面的实际应用。
排序理由 用户生成的模型在特定应用中能力展示。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →