PulseAugur
实时 06:51:16
实体 Proxy Comparative Reward Reinforcement Learning

Proxy Comparative Reward Reinforcement Learning

PulseAugur coverage of Proxy Comparative Reward Reinforcement Learning — every cluster mentioning Proxy Comparative Reward Reinforcement Learning across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_239372 ·

    新AI框架HLS-Seek优化硬件设计生成

    研究人员开发了HLS-Seek,一个用于从C/C++代码生成硬件设计的新颖框架,该框架优先考虑结果质量(QoR),如延迟和资源利用率。该系统利用带有比较代理奖励模型的强化学习,避免了在循环中进行完全综合的需要,并在预测帕累托最优设计方面取得了高精度。HLS-Seek还包含一个感知不确定性的蒙特卡洛Dropout切换机制,以使用真实的综合数据来改进其代理模型,与现有方法相比,从而提高了性能并加快了训练速度。