实体
ShinkaEvolve
ShinkaEvolve
PulseAugur coverage of ShinkaEvolve — every cluster mentioning ShinkaEvolve across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
简单的决策规则在医学人工智能推理中优于广泛搜索
一篇新发表在arXiv上的研究论文探讨了多图像医学推理,发现简单的代理决策规则比广泛的搜索预算更有效。该研究在MedFrameQA数据集上比较了五种推理时策略,其中“order-vote”策略实现了57.89%的最高准确率。这种方法显著优于固定基线和更复杂的“order-rerank”变体。值得注意的是,扩展演化搜索预算并未带来进一步的改进,这表明对于此类医学推理任务,决策规则的设计是更关键的因素。
-
新框架增强了LLM在对抗游戏中的策略演化
研究人员开发了一个名为FAMOU的新框架,以改进对抗游戏中LLM驱动的策略演化。该框架通过引入协同进化机制、分层深度评估和动态弱点压力,解决了评估环境变化的挑战。在MCTF 2026 3v3海上夺旗任务上进行的测试中,FAMOU的表现优于现有方法,取得了最高的综合得分,并能更好地泛化到未见过的对手。演化出的策略还展示了新颖的算法创新,验证了该方法的有效性和现实世界的可迁移性。