Reddit的r/MachineLearning板块的一位用户正在就多智能体强化学习(MARL)模型的比较研究的超参数调优寻求建议。他们正在各种MARL任务上训练PPO变体,并观察到最佳超参数在不同架构和场景下有所不同。核心问题是是否应统一这些超参数以进行公平比较,同时承认这有时会导致模型不收敛。用户的最终目标是测试这些模型在对抗性攻击下的鲁棒性。 AI
影响 阐明了确保比较性AI研究方法严谨性的最佳实践。
排序理由 用户关于AI模型比较研究方法论的查询。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →