一位Reddit用户进行了一项实验,以了解普通人是否能区分不同的AI模型。参与者被告知他们使用的是ChatGPT的限时免费版本,但实际上,他们与包括Qwen和Gemma变体在内的一系列本地模型进行了交互。实验显示,用户注意到了小型模型的质量下降,当模型参数量在9B及以下时出现了抱怨。参与者普遍更喜欢Gemma模型的响应,并发现大型模型有时似乎“想得太多”。 AI
排序理由 这是一个在Reddit上由用户生成的实验,并非正式的研究论文或行业公告。
- AI models
- ChatGPT
- Gemma 12B
- Gemma 26B-A4B
- Gemma E2B
- Gemma E4B
- Qwen 3.5 9B
- Qwen 3.6 27B
- Qwen 3.6 35B-A3B
- Qwen 3.8 27B
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →