PulseAugur
实时 20:15:46
实体 Generative Flow Networks

Generative Flow Networks

PulseAugur coverage of Generative Flow Networks — every cluster mentioning Generative Flow Networks across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 9
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 9
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 9 条
  1. TOOL · CL_167467 ·

    新的回归损失增强了生成流网络训练

    研究人员为生成流网络(GFlowNets)开发了新的回归损失函数,以改进其训练过程。通过将回归损失与特定的散度度量联系起来,该团队设计了三种新颖的损失:Shifted-Cosh、Linex(1/2)和Linex(1)。这些新损失可以增强探索和利用,从而在超网格、比特序列生成和分子生成等任务中实现更快的收敛、更大的样本多样性和更高的鲁棒性。

  2. RESEARCH · CL_93670 ·

    新的MCMC方法使用神经网络自适应地停止采样

    研究人员开发了一个新框架,该框架使用神经网络分类器来自适应地确定何时停止马尔可夫链蒙特卡洛(MCMC)方法的采样。这种方法被置于生成流网络(GFlowNets)的框架内,通过训练分类器来识别高密度区域,从而缩短轨迹长度并提高采样效率。该方法通过详细平衡条件,在理论上将最优分类器与目标密度联系起来,并在实验中与传统的MCMC基线相比,在模式覆盖和混合方面显示出显著的改进。

  3. RESEARCH · CL_72506 ·

    GFlowNets 被证明可学习最优传输方案

    研究人员建立了生成流网络 (GFlowNets) 与最优传输 (OT) 之间的理论联系。他们的工作表明,非循环 GFlowNets 在优化后可以有效地编码最优传输方案。这种联系使得 GFlowNet 框架能够通过神经参数化和边流应用于大规模 OT 问题,实验表明与现有的 OT 求解器一致。

  4. TOOL · CL_65686 ·

    GFlowGR框架使用生成流网络进行推荐微调

    研究人员推出了一种新颖的生成推荐系统微调框架 GFlowGR,该框架利用生成流网络(GFlowNets)。该方法旨在解决当前方法(如监督微调(SFT)和直接偏好优化(DPO))中固有的暴露偏差问题。GFlowGR 整合了传统推荐系统的协同知识,以创建自适应采样器和奖励模型,从而减轻暴露偏差并提高推荐质量。

  5. TOOL · CL_59011 ·

    新的GFlowNet框架组合预训练模型用于多目标生成

    研究人员开发了一个新的生成流网络(GFlowNets)框架,允许在推理时组合预训练模型。这种方法无需重新训练即可快速适应新的多目标生成任务。该框架支持从线性标量化到复杂非线性算子的灵活奖励组合,并在合成和真实世界的分子生成任务上展示了与现有方法相当的性能。

  6. TOOL · CL_58805 ·

    新的GFlowNet训练方法提高了LLM前缀平衡性和多样性

    研究人员引入了一种新的生成流网络(GFlowNets)训练方法,称为Rooted absorbed prefix Trajectory Balance (RapTB),旨在解决大型语言模型中的前缀崩溃和长度偏差等问题。RapTB通过将子轨迹监督锚定在根部并向中间前缀传播奖励来改进信用分配。此外,还提出了一种名为SubM的子模态回放刷新策略,以对抗由有偏回放引起的分布偏移,从而在训练流中同时促进高奖励和多样性。在分子生成等任务上的实证结…

  7. TOOL · CL_51120 ·

    新的 GFlowNet 训练方法改进了离线学习

    研究人员开发了一种新的无代理生成流网络(GFlowNets)训练框架,称为轨迹蒸馏 GFlowNet(TD-GFN)。该方法使用逆强化学习从离线轨迹中提取详细奖励,提供比以往方法更丰富的指导。TD-GFN 通过依赖真实终端奖励来确保训练稳定性,避免错误传播,并在收敛性和样本质量方面优于现有方法。

  8. TOOL · CL_48977 ·

    AI框架利用生成网络加速无线电传播建模

    研究人员开发了一个新的机器学习框架,使用生成流网络来显著加速无线电传播建模。该方法通过智能采样路径而不是穷举搜索路径来解决传统射线追踪的计算复杂性。该系统包含一个经验回放缓冲区、一个统一的探索策略和基于物理的动作掩码,以处理稀疏奖励并确保稳健的学习。虽然在理想化场景中实现了显著的加速并保持了准确性,但该模型需要进一步的改进才能有效地推广到复杂的真实城市环境。

  9. RESEARCH · CL_14207 ·

    Stable-GFN通过稳定、多样化的攻击生成来增强LLM红队测试

    研究人员推出Stable-GFlowNet (S-GFN),这是一种旨在增强大型语言模型 (LLM) 红队测试的多样性和鲁棒性的新方法。该方法通过成对比较消除分区函数估计,并引入流畅性稳定器以防止次优输出,从而解决了在使用生成流网络 (GFN) 识别 LLM 漏洞时遇到的训练不稳定和模式崩溃问题。