一篇新的研究论文介绍了一种名为山丘采样(Hill Sampling)的新颖方法,用于提高大型语言模型(LLMs)在测试时的性能。该技术包括从一个固定的LLM中重复采样候选程序,并将后续采样条件化为迄今为止找到的最佳程序。山丘采样在圆盘填充问题上取得了最先进的结果,并在Erdos的最小重叠问题上提高了性能,优于进化策略(Evolution Strategies)和重复采样等更复杂的方法。 AI
影响 该方法提供了一种更简单、更有效的方法来增强LLM在测试时的能力,有可能降低复杂问题解决的计算成本。
排序理由 该集群包含一篇详细介绍LLM新方法的 ist 研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
- AlphaEvolve
- circle packing
- Evolution Strategies
- Hill Sampling
- large-language models
- Nvidia H100 GPUs
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →