arXiv cs.LG
PulseAugur coverage of arXiv cs.LG — every cluster mentioning arXiv cs.LG across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
New minimax lower bound established for diffusion-based local intrinsic dimension estimation
研究人员为估计FLIPD(一种基于扩散的局部内在维度(LID)量)的有限尺度总体函数开发了一个minimax下界。该量由高斯平滑密度的对数尺度导数定义。研究表明,在正则流形模型下,有限尺度场与流形维数的偏差最多为 $O(\sigma^2)$。所建立的minimax下界在从特定范围 $\sigma$ 内的 $n$ 个观测值估计该场时,其阶数为 $(n\sigma^d)^{-1}$。
-
新研究详解神经网络泛化中的“通道化”现象
研究人员在过参数化神经网络中识别出一种称为“通道化”的现象,它描述了拟合训练数据的解的选择在训练过程中如何演变。这一过程在三个“grokking”任务中均有观察到,涉及在可见泛化出现之前出现的、对权重衰减脉冲的有序时间敏感性。研究表明,这种通道化通过约束解空间来帮助选择泛化能力更好的解。
-
新框架正式化交易策略的“进化时间价值”
研究人员推出了一种名为 Lineage-Value Policy Gradients (LVPG) 的新型 actor-critic 框架,用于发现自动化交易策略。该方法通过正式化“进化时间价值”来解决进化搜索中即时回报控制的局限性,该价值承认某些突变的延迟效用。LVPG 利用自举的 critic head 来估计有限视野谱系潜力的价值,并利用 actor head 来管理突变强度,与传统优化方法相比,在验证 AUC 方面有了显著提高…
-
新的子图滤波器学习框架解决了图数据不完整的问题
研究人员引入了一个名为子图滤波器学习(SFL)的新颖框架,以解决图信号处理中图拓扑信息通常不可用的挑战。该框架提出在仅可获得部分观测值的情况下,使用子图支持算子来近似环境图滤波器。该方法将SFL构建为统计学习问题,并引入了基于距离感知拉普拉斯构造的子图滤波器代数,以定义一类可控的滤波器。在真实数据集上的实验表明,该代数模型优于现有的多项式滤波器和分布无关算子等方法。
-
新框架评估多视图预训练中的查询可识别性
研究人员开发了一个正式框架,用于确定多视图预训练场景中的查询可识别性,其中来自多个来源的数据通过共享接口进行集成。他们证明了查询中的歧义是结构性的,无法通过简单地收集更多数据或训练更大的模型来解决。该研究引入了能够有效判断可识别性并找到最小接口添加以解决歧义的算法,实验证实了它们的有效性,并预测了仅依赖接口证据的估计器存在不可约误差下限。
-
新算法解决了线性动力学系统在线学习的复杂问题
研究人员开发了一种新的线性动力学系统(LDS)在线学习统一算法。该算法旨在实现亚线性遗憾,同时将其内存使用量调整为适应系统动力学的内在复杂性,而不是完整的隐藏状态维度。重点是具有低不稳定性复杂性的系统,这些系统是可稳定化的。所提出的算法处理所有LDS,包括不可对角化系统,其可学习参数数量为$\widetilde{O}(k)$,其中$k$代表不稳定性复杂性。理论下界证实$k$是一个有效的复杂性度量,实验结果表明其性能优于先前的方法。
-
AI模型利用计算机视觉技术识别放射性同位素
研究人员开发了一种新颖的机器学习方法,用于在城市环境中识别放射性同位素,将伽马射线数据转换为频谱图,供计算机视觉架构进行分析。该方法编码了光谱和时间信息,增强了神经网络区分威胁信号和背景噪声的能力。在RADAI基准数据集上的评估表明,卷积神经网络(CNN)的性能优于先前的方法,在低误报率下实现了更高的检测、分类和识别率。
-
新研究使用经济学模型优化Airbnb的市场动态
本文探讨了如何理解和优化双边市场,并以Airbnb为例。它结合了经济学建模和因果推断,分析了基于房东设定的价格和其他因素的房客预订行为。该研究旨在改进Airbnb为房东设定的有竞争力的价格的工具,并为改善匹配的房客体验进行个性化。
-
研究发现:地理空间AI模型在农业领域的迁移能力较差
一篇新论文评估了三个地理空间基础模型——Prithvi、SpectralGPT和SatMAE——在农业应用中的有效性。研究发现,当迁移到新的地理区域时,这些模型的性能会显著下降,并且难以准确预测不太常见的作物。研究还强调,模型处理输入格式的差异使得直接进行架构比较变得复杂,这凸显了在农业地理空间AI领域制定区域感知评估标准的必要性。
-
新研究论文详述用于复杂推理的课程学习
一篇题为《Learning to Reason with Curriculum II: Compositional Generalization》的新研究论文探讨了如何将复杂问题分解为更简单的子问题,从而实现更高效的学习。该研究侧重于模拟半自动机,证明与直接方法相比,基于课程的方法显著减少了所需的监督量。这种方法在监督微调和具有可验证奖励的强化学习等场景中显示出提高学习效率的潜力。
-
已撤稿的arXiv论文为归一化嵌入中的余弦相似度辩护
这篇最初提交给arXiv的论文已被作者撤回。它旨在为学习嵌入中的余弦相似度辩护,认为先前识别出的与“规范”矩阵相关的歧义仅在嵌入未归一化时才存在。作者提出,通过在训练期间或之后将嵌入约束在单位球上,歧义就会消失。他们证明,在归一化嵌入上,余弦相似度与欧氏距离的平方的一半单调等价,这表明感知到的问题在于未能归一化,而不是余弦相似度本身。
-
新框架通过自洽路径统一生成模型
研究人员引入了一个新的生成模型理解框架,侧重于“自洽生成路径”的概念。该框架将路径定义为自洽的,如果它代表了容许局部变分传输校正的随机不动点。该理论产生了一个称为随机不动点路径残差(R-FPR)的度量,用于量化生成路径与其校正之间的差距,为诊断和改进各种生成模型提供了一个原则。
-
新型AI架构实现物理系统的认证零样本推理
研究人员开发了一种新颖的非对称双通路架构,用于物理信息学习,旨在提高跨不同系统配置的可迁移性。该方法使用带有特权模拟器数据的教师编码器和在稀疏场数据上训练的学生编码器,使学生能够通过单次前向传播进行推理,并带有迁移证书。该框架通过Wasserstein距离建立了迁移条件,并提供了零样本误差界限,在具有未见拓扑的电力系统估计方面取得了显著成功。
-
LLM选择性分类通过成对查询得到改进
研究人员开发了一种用于二元任务选择性分类的新方法,该方法特别适用于执行上下文学习的大型语言模型(LLM)。该技术涉及向同一模型提出额外的成对查询,以识别高错误样本,从而减少非拒绝数据点的预测错误。通过在合成和真实数据集上进行的实验证明,与仅依赖原始置信度估计相比,该方法旨在改善准确性-成本权衡。
-
新框架可从神经信号解码猴子全身运动
研究人员开发了一个新的框架,用于记录和模拟与猴子自然全身运动相关的神经活动。该系统结合了大规模皮层信号和多视角运动捕捉,以重建和解码复杂的运动。开发的自回归编码器-解码器模型能够仅凭神经信号准确预测逼真的全身运动学,为理解灵长类动物的运动控制提供了一种新颖的方法。
-
新算法增强了用于临床数据的贝叶斯网络分类器
研究人员开发了Baymex算法的并行版本,以提高离散化贝叶斯网络分类器学习的可扩展性。这种增强的算法自适应地引导优化以减少过拟合,并针对临床分类任务进行了配置。在真实临床数据集上的评估表明,并行Baymex算法在预测性能上与已建立的基线相当或更优,同时生成了更紧凑且临床上可解释的贝叶斯网络。
-
新的对抗性训练可防御大型语言模型免受不断演变的越狱攻击
研究人员开发了一种新颖的双层对抗性训练框架,旨在防御大型语言模型免受不断演变的越狱提示。该方法通过利用现有拒绝状态激活的无监督潜在方向发现来推断,从而模拟各种越狱激活。然后,该框架训练一个引导场,将这些模拟的对抗状态推入拒绝区域,同时保持模型的良性效用。该方法在三个大型语言模型和六个越狱家族中进行了测试,证明了强大的防御能力,将攻击成功率基本保持在 5% 以下,并通过在训练期间增加子空间覆盖率来提高泛化能力。
-
新的老虎机算法解决了频谱接入中的信道噪声问题
研究人员开发了一种用于机会频谱接入系统信道分配的新算法,解决了现有方法的局限性。该算法是一种上下文多玩多臂老虎机,通过使用信道状态信息作为上下文来考虑信道噪声。这种方法旨在减少遗憾并改善现实场景中的次优臂选择。
-
新研究详解宽神经网络中的特征学习
一篇新研究论文探讨了在最大更新参数化($\mu$P)下,宽两层神经网络中的特征学习。该研究建立了四个关键的结构性结果,包括带噪声梯度下降的均值场极限的全局存在性和唯一性。它还表征了该极限的可识别性,并证明在特定条件下,长时极限测度的活动支撑集允许稀疏字典分解。该研究进一步将总特征学习误差分解为几个组成部分,对学习过程进行了详细分析。
-
研究发现 Min-Max 优化需要指数级查询
一篇新的研究论文探讨了非凸非凹函数 min-max 优化的计算复杂性。该研究表明,对于此类函数,找到近似驻点需要指数级的查询次数,尤其是在考虑近似误差和问题维度时。