PulseAugur
中
实时 20:47:24
实体 information entropy

information entropy

PulseAugur coverage of information entropy — every cluster mentioning information entropy across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
27
90 天内 28
发布 · 30天
0
90 天内 0
论文 · 30天
24
90 天内 24
层级分布 · 90 天
主题
关系
情绪 · 30 天

4 天有情绪数据

最近 · 第 1/2 页 · 共 30 条
  1. TOOL · CL_282188 ·

    主动学习增强了可微神经架构搜索在3D医学图像分割中的应用

    研究人员开发了Active-DiNTS,一种将主动学习与可微神经架构搜索(NAS)相结合的新方法,用于3D医学图像分割。该方法联合优化网络拓扑和标签策展,显著降低了对大量标注预算和多GPU集群的需求。通过使用熵、方差或标准差等不确定性信号对未标记数据进行排序,Active-DiNTS能够有效地选择需要标注的卷,从而在Medical Segmentation Decathlon等基准测试中提高分割精度。

  2. MEME · CL_274666 ·

    Entropy 开发人员解释派对 RPG 中的永久死亡机制

    游戏 Entropy 的开发人员 James Wragg 讨论了在派对式角色扮演游戏中引入永久死亡机制的实现。他解释了拥有大量潜在队员池以方便杀死他们的机制的必要性。

  3. TOOL · CL_258072 ·

    Facebook Marketplace 通过个性化检索系统增强用户多样性

    研究人员开发了 PCap,一个旨在增强 Facebook Marketplace 检索系统内多样性的个性化框架。该系统使用香农熵对个体用户多样性偏好进行建模,并将用户划分为不同的多样性类别。通过在候选检索期间应用个性化类别上限,并采用一种称为参数调优序列的自动化在线优化方法,PCap 旨在改善用户浏览体验。大规模在线实验表明,参与度指标有了显著提升,为将个性化多样性整合到工业检索系统中提供了实践见解。

  4. TOOL · CL_244912 ·

    新AI框架增强软件定义网络中的DDoS检测能力

    研究人员开发了XAI-SDN,一个旨在检测软件定义网络(SDN)中分布式拒绝服务(DDoS)攻击的新机器学习框架。该框架利用香农熵指标和随机森林分类器,并通过SHAP TreeExplainer增强了透明度。XAI-SDN在CIC-DDoS2019基准测试中展示了高准确性,在检测性能上取得了近乎完美的分数,同时保持了高效的处理速度。

  5. TOOL · CL_219090 ·

    拓扑数据分析引入新的持久交叉熵指标

    研究人员引入了持久交叉熵(PCE),一种衡量两个持久性图之间交叉熵的新方法。这一新指标通过使用包含一个图的信息到另一个图的事件空间中的诱导概率,解决了持久性图中不同事件空间带来的挑战。PCE已证明其在区分具有相同持久熵的图、识别动力系统中的因果方向以及作为知识蒸馏的定向拓扑损失方面的效用。

  6. TOOL · CL_206084 ·

    GATTA框架通过测试时增强提升主动学习能力

    研究人员推出GATTA,一个利用测试时增强(TTA)来改进图结构数据上主动学习的新型框架。GATTA聚合来自多个增强视图的预测,以增强不确定性估计,这是主动学习中的一个关键因素。该框架包含一个过滤不可靠增强视图的机制,以确保标签的保留。GATTA已在各种图数据集和GNN架构上证明了其有效性,表明简单的基于不确定性的方法与TTA结合后,可以实现与更复杂方法相媲美的性能,同时降低计算开销。

  7. TOOL · CL_191377 ·

    新证明确立了镜像下降在非凸问题上的收敛性

    研究人员为镜像下降在非凸优化问题上的收敛性提供了证明,特别解决了不排除边界限制的情况。该证明依赖于一种新颖的度量展平重参数化方法,该方法允许定义边界扩展。当应用于涉及香农熵、费米-狄拉克熵和幂核的目标时,该框架证明了收敛到 KKT 点。未来的工作旨在将此方法扩展到更广泛的 Bregman 型算法和更复杂的约束几何。

  8. RESEARCH · CL_191357 ·

    LLM校准研究提出新方法以提高基准可比性和域外泛化能力

    两篇新研究论文提出了改进大型语言模型(LLM)校准的方法。第一篇论文介绍了一个基于项目反应理论(IRT)的框架,该框架使用锚点项目来校准新基准,即使模型在不同数据集上随时间进行评估,也能实现可比的分数。第二篇论文提出了一种双层优化方法,在训练过程中修改模型参数以最大化预测分布的熵,直接针对过度自信问题并提高域外泛化能力。

  9. RESEARCH · CL_185154 ·

    新框架使用信息论解释自闭症的坚持相同性 · 跟踪 2 个来源

    研究人员提出了一个使用信息论来解释自闭症患者中观察到的坚持相同性行为的新框架。这种方法将此类行为视为减少惊讶和不确定性的普遍模式,将自闭症定义为认知功能仅限于环境辨别、记忆和预测的障碍。基于条件熵的拟议指标表明,最小化惊讶可以通过学习新刺激或限制对已知信息的接触来实现,而坚持相同性则与后者一致。该框架旨在量化焦虑和舒适区等概念,并可能通过类似图灵测试的方法为学习疗法和机器人护理的开发提供信息。

  10. TOOL · CL_177393 ·

    基于熵的秘密检测保护LLM上下文窗口

    提出了一种使用香农熵的新方法,以防止API密钥和令牌等敏感信息泄露到LLM上下文窗口中。工具输出熵净化器(Tool Output Entropy Sanitizer),一个MCP服务器,通过计算其不可预测性来识别高熵字符串。这种方法比传统的基于正则表达式的 redaction 更健壮,因为后者在秘密格式发生变化时可能会失效。净化器将敏感段替换为类似'[REDACTED_HIGH_ENTROPY:length]'的占位符,在防止实际数据…

  11. TOOL · CL_154499 ·

    Renyi熵和最小熵估计新界限确立

    研究人员为估计Renyi熵和最小熵(信息论和属性测试中的基本概念)建立了新的样本复杂度界限。该研究为估计k符号字母表的这些熵度量所需的样本数量提供了精确的刻画。值得注意的是,最小熵估计比香农熵需要更多的样本,样本复杂度为\Theta(k \log k),纠正了先前的假设。

  12. TOOL · CL_152012 ·

    基于熵的特征提升网络异常检测性能

    研究人员探索了使用基于熵的特征来增强网络异常检测,由于流量模式多样,这正变得越来越困难。通过将熵计算集成到标准的机器学习流程中,他们在公开入侵检测数据集上发现了分类性能的一致性提升。这种方法补充了传统的统计特征,并为提高异常检测提供了轻量级、可解释的方法,尤其是在高变异流量场景中。

  13. TOOL · CL_148010 ·

    新理论连接牛顿-拉夫逊方法与正则化策略迭代

    研究人员在正则化马尔可夫决策过程(RMDPs)的应用中,正式建立了牛顿-拉夫逊方法与正则化策略迭代(RPI)之间的等价性。这种联系,尤其是在正则化项为香农熵时,使得对RPI进行统一的理论分析并开发加速算法成为可能。研究表明,RPI表现出局部二次收敛性,并提出了一种实现三阶局部收敛的新算法,该算法得到了数值实验的支持。

  14. TOOL · CL_141706 ·

    新理论统一计算硬度和随机性

    研究人员开发了一种统一的伪熵表征,加强了计算硬度和随机性之间的关系。这种新表征适用于均匀和非均匀计算模型,并涵盖了香农熵和最小熵等各种熵概念。一项关键的技术进展涉及使用权重受限校准和计算不可区分性,与以前的方法相比,这在字母表大小依赖性方面带来了指数级的改进。

  15. TOOL · CL_134411 ·

    信息论可视化指南发布,助力AI发展

    Omar Sanseviero 分享了一份信息论的可视化入门指南,强调了其在AI背景下的美妙之处和强大功能。该指南旨在提供熵和互信息等概念的直观理解,仅需基本的概率知识。它旨在解释数据压缩和传输的基本极限。

  16. TOOL · CL_138244 ·

    新的LP-SFT方法保留语言模型熵结构

    研究人员推出了一种新颖的监督微调方法LP-SFT,旨在保留预训练语言模型固有的多模态熵结构。标准的微调方法可能仅关注目标token而忽略模型对其他可能选项的广泛理解,从而损害现有能力。LP-SFT通过分析和维护模型代表丰富分布知识的熵峰来解决这个问题。实验表明,LP-SFT通过缓解能力退化并保留采样多样性,提高了性能并平衡了准确性指标。

  17. RESEARCH · CL_128502 ·

    新的LP-SFT方法在微调过程中保留语言模型能力

    研究人员推出了一种新颖的监督微调方法LP-SFT,旨在保留预训练语言模型固有的熵结构。标准的微调会因过度关注目标标签词元而损害现有能力。LP-SFT通过维持替代合理词元之间的相对结构来解决这个问题,从而在不牺牲采样多样性的情况下缓解能力退化。实验表明,LP-SFT在平衡准确性和更广泛的性能指标方面优于普通SFT和其他增强基线。

  18. TOOL · CL_121373 ·

    通过熵控制增强大型语言模型的创意写作能力

    研究人员开发了一种新颖的方法,通过操纵大型语言模型(LLM)的输出熵来增强其创意写作能力。该技术涉及在文本生成过程中调整温度参数,该参数会影响输出的随机性和创造力。通过仔细控制熵,LLM可以生成更多样化和富有想象力的内容,超越可预测或重复的文本。

  19. RESEARCH · CL_117259 ·

    新理论将熵与深度学习极限联系起来,并提出了EGD算法

    研究人员引入了一个新的理论框架,该框架将信息论、拓扑学和统计力学联系起来,以理解深度神经网络中可学性的极限。该框架定义了一个“熵可学性视界”(Entropic Learnability Horizon, ELH),这是一个基本定律,规定只有当数据的流形香农熵超过函数决策边界的拓扑熵(由网络权重空间的熵调节)时,网络才能学习目标函数。当目标边界的复杂性超过这个信息视界时,系统就会进入“信息性挫败”(Informational Frust…

  20. TOOL · CL_100084 ·

    信息格学习被构建为概率图模型结构学习

    一篇新论文将信息格学习(ILL)引入作为概率图模型(PGM)结构学习的一种方法。ILL通过将信号投影到抽象层次结构上,来学习可解释的规则。当应用于概率质量函数时,ILL学习到的规则可以被解释为因子图中的约束,这与最大熵模型密切相关。该框架为推理和混合符号-概率学习提供了新的途径。