PulseAugur
实时 14:01:39
实体 AppWorld

AppWorld

PulseAugur coverage of AppWorld — every cluster mentioning AppWorld across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. RESEARCH · CL_37215 ·

    Hugging Face launches Open Agent Leaderboard for AI systems

    Hugging Face has launched the Open Agent Leaderboard, a new framework for evaluating the performance and cost of AI agent systems. This benchmark focuses on assessing an agent's generality across diverse tasks and setti…

  2. TOOL · CL_47619 ·

    新的HINT-SD框架提高了LLM智能体训练效率

    研究人员开发了HINT-SD,一个旨在提高长时序大型语言模型(LLM)智能体训练效率和效果的新框架。该方法侧重于识别和纠正轨迹中导致任务失败的特定动作,而不是对每一个回合都应用反馈。通过利用后视分析来定位这些关键决策点,HINT-SD显著减少了训练所需的时间和计算资源,在BFCL v3和AppWorld等基准测试中的改进证明了这一点。