实体
phi4:14b
phi4:14b
PulseAugur coverage of phi4:14b — every cluster mentioning phi4:14b across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
Persona塑造LLM Agent在策略游戏中的行为
研究人员调查了Persona提示如何影响大型语言模型Agent在“分还是偷”游戏中的策略行为。他们使用了四种开源模型(Ministral-3-3B、phi4:14b、Gemma3:12b和Gemma4:e4b)与一个由GPT-4.1 mini驱动的虚拟人类进行交互,发现相互“分”的结果占主导地位,约占回合数的74%。模型选择显著影响了Agent的行为,phi4和Ministral-3-3B始终表现出合作性,而Gemma模型则展现出更多…
-
RAG 基准测试缺陷揭露:分块策略而非 LLM 驱动结果
一位开发检索增强生成(RAG)系统的开发者遇到了其基准测试的问题,发现分块策略和问题难度的变化同时改变了模型排名。该开发者发现,基准测试并未准确衡量 LLM 能力,而是衡量了分块配置的有效性。在对 Transformer 论文的一个特定问题进行检索失败导致模型回答错误后,尽管答案存在于原始文档中,开发者才意识到这一点。