RAPTOR+
PulseAugur coverage of RAPTOR+ — every cluster mentioning RAPTOR+ across labs, papers, and developer communities, ranked by signal.
3 天有情绪数据
-
AI 框架 GridCodex 增强电网代码推理和合规性
研究人员开发了 GridCodex,一个旨在协助电力行业进行复杂电网代码推理和合规性的新框架。该系统利用大型语言模型和检索增强生成 (RAG),结合了多阶段查询精炼和一种称为 RAPTOR 的增强检索方法。基准测试表明,GridCodex 将答案质量显著提高了 26.4%,并将召回率提高了十倍以上,满足了对电网法规自动解释的关键需求。
-
新的SAPER框架修剪Vision Transformer注意力头以提高效率
研究人员开发了SAPER,一种用于修剪Vision Transformer中注意力头的新颖框架。该方法利用基于注意力图的拉普拉斯特征向量的谱分析和可视化技术来识别和聚类冗余的注意力头。SAPER采用LapSum Soft Top-K方法,在ImageNet-1K上展示了有利的准确性-效率权衡,在FLOPs减少方面优于RAPTOR基线,同时保持了强大的分类性能。
-
RAG 技术测量:语料库特定测试揭示了组合上的竞争
最近对 46,000 个块的语料库上检索增强生成 (RAG) 技术进行的测量显示,许多宣传的方法是竞争而非组合,并且它们的有效性高度依赖于特定的语料库和 RAG 管道内的阶段。作者发现,由于延迟和 token 成本,查询时技术必须设定更高的标准。主要发现表明,朴素的密集检索表现不佳,并且一种结构化的分块方法,侧重于解析和结构边界而不是仅仅 token 数量,对于有效的摄取至关重要。
-
新的RAG框架应对可靠性和准确性挑战 · 已追踪2个来源
两篇新的研究论文介绍的先进检索增强生成(RAG)系统框架,旨在提高代理AI的可靠性和准确性。LayerRAG-Bench提出了一个基准,用于评估RAG系统在不同可靠性层面的表现,识别证据、工具使用和授权方面的失败。VecTree-RAG提出了一个新颖的框架,结合了向量和树检索方法,以更有效、更准确地在科学文献中定位证据,在多个基准测试中表现优于现有的RAG方法。
-
AI火箭发动机初创公司LegendSpace获2950万美元天使轮融资
专注于人工智能驱动火箭发动机开发的中国初创公司LegendSpace已获得2950万美元天使轮融资。该公司利用其专有的“Prime”平台,该平台集成了AI设计、模拟、增材制造和测试,将发动机迭代周期从数年大幅缩短至约两周。本轮融资将用于支持多台液体火箭发动机的测试、增强“Prime”平台的各项能力,并建立大规模生产的生产测试体系。
-
SpaceX 因发动机点火故障中止星舰试飞
SpaceX 的第13次星舰试飞在起飞前因多个猛禽发动机故障而中止。首席执行官埃隆·马斯克证实了该问题,称有两个发动机未能按预期点火,触发了自动中止程序。该公司计划更换故障发动机,并争取最早下周进行下一次发射尝试。
-
新的RAPTOR方法提高了时序知识图谱推理效率
研究人员开发了RAPTOR,一种新颖的预训练方法,旨在提高时序知识图谱(TKG)推理的效率。这种自监督方法将可达性感知的归纳偏置注入到智能体中,使其能够更好地估计动作导向目标实体的潜力。通过减少对无望路径的探索,RAPTOR为强化学习(RL)微调提供了强大的初始化,从而在ICEWS14、ICEWS05-15和ICEWS18等数据集上显著提高了训练效率和性能。
-
前DeepMind三人组创立的AI公司EquiLibre为其交易AI完成A轮融资
EquiLibre Technologies是一家由三名前DeepMind研究人员创立的初创公司,已获得由Creandum领投的A轮融资。该公司利用AI,特别是类似于他们之前开发的扑克AI所使用的强化学习技术,为量化对冲基金交易股票和管理资产。EquiLibre声称自2025年成立以来,保持着零亏损月份的完美记录,并在主要市场交易数十亿美元的日交易量。
-
LLM引导的规划系统提高了核监管文件的准确性
研究人员开发了一个LLM引导的规划系统,旨在提高对复杂核监管文件的多跳推理能力。该系统将任务构建为一个规划问题,其中LLM代理使用浏览、阅读和搜索等工具导航文档树,并维护一个动态知识图谱。在针对NuScale最终安全分析报告文件的200个问题的基准测试中,该系统达到了81.5%的准确率,显著优于PageIndex、LightRAG、HippoRAG和GraphRAG等其他RAG方法。
-
AI工程学演进:束带与循环概念涌现
文章讨论了AI工程学术语的演变,从提示工程和上下文工程超越,到2026年人类开发者提出的“束带工程”(harness engineering)和“循环工程”(loop engineering)。束带工程侧重于围绕大型语言模型的确定性运行时层,管理工具调用和执行;而循环工程则涉及设计自主代理循环。作者强调了人类监督和验证在AI开发中的重要性,并以RAPTOR和llloop等个人原型为例来说明这些概念。
-
开发者开源 SEQUOIA RAG 系统,性能超越 7 个管道
一位开发者开发并开源了一个名为 SEQUOIA 的检索增强生成(RAG)系统,该系统在使用真实银行文档和技术手册的基准测试中,持续优于其他七种 RAG 配置。SEQUOIA 结合了基于 RAPTOR 树的分层检索和步进提示(step-back prompting)技术,该技术在检索前泛化查询,可提高约 15% 的召回率且无额外延迟。开发者强调学术基准测试可能具有误导性,并建议在实际数据上测试 RAG 系统,同时指出可以使用本地 LLM…
-
新的剪枝技术将公共交通路线规划速度提高了57%
研究人员开发了一种名为早期剪枝的新技术,可以显著加快RAPTOR等公共交通路线规划算法的速度。该方法通过预先排序连接并及早丢弃更长、效率较低的路线来优化换乘计算。早期剪枝可以与现有系统集成,并在真实交通网络上实现了高达57%的查询时间缩减,而不会牺牲找到路线的最优性。
-
新的VLM框架改进了临床癌症转诊处理
研究人员开发了RAPTOR+,一个利用视觉-语言模型(VLMs)的模态框架,用于改进临床癌症转诊的处理。该系统旨在通过将提取的信息直接链接到转诊文件中的视觉证据来提高信任度和可审计性。在结直肠癌转诊上的评估表明,经过微调的模型,特别是Qwen3-VL-8B,在阅读准确性和可验证证据基础方面显著优于Gemini 2.5 Flash等零样本模型,突显了任务特定微调对于可靠的临床文件理解的必要性。
-
New Dijkstra algorithm optimizes public transit routing
研究人员开发了一种名为 Transfer Aware Dijkstra (TAD) 的新算法,以改进公共交通系统的路径查找。该算法正确考虑了站点缓冲时间,这对于换乘乘客至关重要。在伦敦和瑞士网络上进行的实验表明,与现有方法相比,TAD 的速度提高了两倍以上,同时确保了最优的路由结果。
-
SpaceX发射升级版星舰进行第12次试飞
SpaceX于5月22日成功从德克萨斯州发射其星舰火箭进行第12次试飞。此次飞行使用了升级版的星舰飞船和超重型助推器,配备了增强型Raptor发动机和重新设计的发射台。主要目标是在实际飞行环境中测试这些新系统和组件的性能。
-
PersonalAI 2.0 通过知识图谱和规划增强LLM
研究人员开发了PersonalAI 2.0 (PAI-2),一个通过整合外部知识图谱来改进大型语言模型 (LLM) 系统的新框架。PAI-2采用动态、多阶段查询处理管道,用于自适应、迭代式信息搜索,其性能优于现有的图检索增强生成 (GraphRAG) 方法。评估表明,PAI-2在事实正确性和减少幻觉率方面取得了显著的提升,尤其得益于图遍历算法和搜索规划机制的特定增强。
-
新的Psi-RAG框架改进了LLM的跨文档检索
研究人员引入了$\Psi$-RAG,一个旨在改进跨文档问答的检索增强生成(RAG)的新框架。这种新方法通过采用迭代合并和折叠过程来构建层次抽象树索引,解决了现有基于树的RAG方法的局限性,如结构隔离和粗粒度抽象。$\Psi$-RAG还具有一个多粒度检索代理,可增强查询处理并利用混合检索器。该框架在跨文档多跳QA基准测试中表现出显著的性能提升,比RAPTOR提高了25.9%,比HippoRAG 2提高了7.4%。