PulseAugur
中
实时 20:59:16
实体 Mirage

Mirage

PulseAugur coverage of Mirage — every cluster mentioning Mirage across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
19
90 天内 19
发布 · 30天
0
90 天内 0
论文 · 30天
15
90 天内 15
层级分布 · 90 天
主题
时间线
  1. 2026-06-14 product_launch Microsoft Research unveiled Mirage, a video world model with persistent spatial memory. 来源
  2. 2026-05-22 product_launch The MIRAGE system was developed as a novel approach to AI security, using honeypots to counter prompt injection attacks. 来源
情绪 · 30 天

4 天有情绪数据

最近 · 第 1/1 页 · 共 19 条
  1. TOOL · CL_284406 ·

    Cleave编译器优化大型模型的张量程序

    研究人员开发了Cleave,这是一种新的机器学习编译器,旨在优化大型模型的张量程序。Cleave采用符号解耦策略,首先在具有符号形状的图上执行超优化,然后在具体形状上调度转换后的图。这种方法可以有效地处理具有多个归约的计算,并已显示出显著的速度提升,生成的内核比现有基线快2.8倍。

  2. TOOL · CL_280438 ·

    新的 MIRAGE 方法增强了 JWST 系外行星大气层检索

    研究人员开发了一种名为 MIRAGE 的新方法,以提高从詹姆斯·韦伯太空望远镜 (JWST) 数据中检索系外行星大气的准确性。传统的基于模拟的推理方法在合成光谱上进行训练,但由于一个缺失的潜在变量——行星半径——而难以处理真实的 JWST 观测。MIRAGE 通过用半径信息增强推理过程来解决这个问题,从而实现更准确且与文献一致的检索。该方法已成功应用于多个 JWST 目标,证明了其在不同仪器和数据处理管道上的鲁棒性。

  3. TOOL · CL_259236 ·

    新的MIRAGE研究揭示了多模态代理证据使用的缺陷

    一项题为MIRAGE的新研究介绍了一个用于多模态大型语言模型(MLLM)代理的受控评估框架,重点关注它们在对话中检索和利用历史证据的能力。研究揭示了基于对话状态的证据使用的不同失败模式,特别指出开放权重模型在来源受损时难以处理上下文连续性和通过工具进行的检索。研究结果表明,当前的仅结果评估可能高估了代理的能力,需要一种考虑状态变化的更细致的方法。

  4. TOOL · CL_245137 ·

    新的MIRAGE基准测试了网络代理的调查能力

    一个名为MIRAGE的新基准已被开发出来,用于评估自主网络代理的调查能力。该基准包含750个跨维基百科取证、购物管理和Reddit版主任务的多步决策任务,每个任务都有一个可能具有误导性的可见表面上下文和一个需要主动调查的隐藏上下文。对八个LLM代理的评估显示,尽管代理可以访问相关页面,但它们难以提取决定性证据,在面对矛盾信息时常常失败,并表现出显著的调查性幻觉率。

  5. TOOL · CL_166853 ·

    新的MIRAGE框架解决了推荐系统中的“欧几里得空隙”问题

    研究人员开发了MIRAGE,一种用于序列推荐系统的新型框架,该框架解决了嵌入空间中“欧几里得空隙”的问题。当物品之间的连续嵌入路径穿过语义证据稀疏的区域时,就会出现这些空隙,导致推荐不准确。MIRAGE利用物品共现图来指导嵌入几何形状,将插值路径状态与局部锚点对齐,并将轨迹固定在有效的物品支持上。这种方法可以实现准确的单步推理,同时在真实世界的数据集上显著优于现有的最先进基线,尤其是在稀疏观察到的物品方面。

  6. TOOL · CL_162584 ·

    AI字幕生成成本从免费到每月159美元不等

    为视频生成字幕的成本差异很大,从CapCut和Meta的Instagram Edits等免费服务到基于订阅的工具和API访问。Sonix等服务的自动字幕收费约为每分钟0.167美元,而OpenAI的语音识别API低至每分钟0.003美元。Captions(现已更名为Mirage)提供从免费到每月69.99美元的分级套餐,最近获得了7500万美元的融资,但在更名后面临用户关于稳定性和同步问题的投诉。

  7. RESEARCH · CL_156386 ·

    MIRAGE模型增强MRI造影增强预测

    研究人员开发了MIRAGE,一种新颖的二维U-Net模型,旨在从造影前切片推断乳腺MRI中的造影增强。该模型整合了全局重建和感知损失,以及专门的病灶感知监督,包括对漏诊的肿瘤增强和多尺度辅助肿瘤分割的惩罚。在MAMA-SYNTH数据集的301个病例上进行评估,MIRAGE在多个指标上表现优越,与Pix2Pix和条件扩散模型等现有基线相比,显著提高了下游病灶定位的准确性。

  8. RESEARCH · CL_128492 ·

    新的MIRAGE防御系统可对抗长篇RAG中的虚假信息

    研究人员开发了MIRAGE,一种用于检索增强生成(RAG)系统的新型防御机制,旨在对抗长篇内容中的虚假信息污染。这种无需训练且与模型无关的方法利用自然语言推理(NLI)构建跨文档声明图,以识别和过滤掉误导性或虚假信息。MIRAGE可以根据多个来源支持的证据子集来条件化生成,或者完全阻止检索,为提高RAG输出在各种基准测试和LLM上的事实准确性提供了强大的解决方案。

  9. SIGNIFICANT · CL_94597 ·

    美国对 Anthropic 模型实施出口管制,向欧洲发出警告;Microsoft 推出 Mirage 以加速视频生成

    Anthropic 的 Fable 5 和 Mythos 5 模型受到美国出口限制,对欧洲发出警告。敦促布鲁塞尔重新评估其对美国技术的依赖,以防止未来华盛顿的决定阻碍当地经济。与此同时,Microsoft Research 推出了 Mirage,一个将 3D 几何体存储为潜在特征而非像素的系统,显著加速了视频生成并解决了室内失真问题。

  10. TOOL · CL_93980 ·

    MIRAGE框架提升了MLLM的图像检索准确性和效率

    研究人员推出了一种名为MIRAGE的新框架,旨在提高多模态大语言模型(MLLM)中多向量图像检索(MVR)的效率和准确性。MIRAGE通过采用分层方法来解决当前MVR系统的局限性,该方法能更好地使查询与不同的图像对象对齐,并通过跨层级相似性一致性减少冗余计算。该系统还为各种数据集自动化参数配置,提高了其实用性。实证结果表明,与现有的MVR系统相比,MIRAGE的准确性显著提高,同时计算成本降低了高达3.5倍。

  11. TOOL · CL_93686 ·

    新的MIRAGE基准揭示了大型语言模型中加剧的反穆斯林偏见

    一个名为MIRAGE的新基准已被开发出来,用于评估大型语言模型中的反穆斯林偏见,它超越了简单的提示完成,评估了推理、代理决策和时序耦合条件。研究发现,思维链推理会加剧偏见,代理决策表现出不对称性,并且偏见会随着近期冲突背景的增加而增加。现有的缓解技术在这些条件下转移性很差。

  12. RESEARCH · CL_90265 ·

    微软的 Mirage 视频模型使用空间记忆实现更快生成

    Microsoft Research 开发了 Mirage,这是一种新颖的视频世界模型,它利用直接存储在其潜在空间中的持久空间记忆。与传统的基于像素的方法相比,这种方法显著减少了计算时间和内存需求,使视频生成速度提高了 10.5 倍,内存使用量减少了 55 倍。虽然 Mirage 在长距离摄像机移动中保持空间一致性方面表现出色,但它在可靠跟踪不同视频片段中的移动对象方面仍存在困难。

  13. TOOL · CL_79799 ·

    新的 MIRAGE 方法通过元数据和 FAIR 原则增强 MSR 数据集分析

    研究人员开发了 MIRAGE,一种通过增强元数据和评估 FAIR 原则来分析软件开发库挖掘 (MSR) 数据集的新方法。该方法使用 Semantic Scholar API 收集 2013 年至 2024 年的数据,并应用潜在狄利克雷分配 (LDA) 主题建模进行分析。研究发现,存储库托管网站和数据格式会影响引用模式和可用性,表明改进的注释可以提高数据集的可发现性和可重用性。

  14. RESEARCH · CL_79453 ·

    新基准和框架推动视频世界建模发展

    研究人员推出了“ImageTime”,这是一个旨在评估图像生成模型理解和表示时间变化能力的新基准。该基准通过要求模型生成一个动作的四个有序关键状态来评估时空一致性,超越了单一图像质量指标。此外,还开发了一个名为BiWM的新框架,利用双向自回归来推进开源交互式视频世界模型,旨在提高生成质量和推理速度。另一篇论文提出了一种用于视频世界模型的“潜在空间记忆”,将场景信息直接存储在扩散潜在空间中,从而显著加快生成速度并减小内存占用。

  15. TOOL · CL_59100 ·

    新的OmniAID框架改进了AI生成图像的检测

    研究人员开发了OmniAID,一个用于检测AI生成图像的新框架,该框架将语义缺陷与通用伪影分离开来。这种方法使用了一个专家混合(Mixture-of-Experts)架构,其中包含针对不同内容领域的专用专家和一个针对内容无关伪影的固定专家。两阶段的训练过程进一步优化了模型有效路由输入的能力。该框架还附带了Mirage,一个旨在测试现代、真实世界AI生成图像的大规模数据集,并且在性能上优于现有的检测方法。

  16. TOOL · CL_58928 ·

    新的MIRAGE框架通过多模态门控增强fMRI编码

    研究人员开发了MIRAGE,一个用于编码全脑fMRI对自然视听刺激响应的新框架。该模型利用原生的多模态骨干网络和跨层的自适应特征门控来整合视觉、听觉和语言信息。MIRAGE通过原生组合多模态特征而非事后聚合单一模态特征,优于现有方法,在整个皮层提供了更高的预测准确性和可解释的模态特定门控模式。

  17. RESEARCH · CL_48788 ·

    新框架和基准测试推动移动 GUI 代理能力发展

    研究人员开发了几个新的框架和基准测试,以推进移动 GUI 代理的能力。STAMP 为虚拟环境中的代理引入了显式内存训练,提高了任务的韧性。PhoneWorld 提供了一个可扩展的管道,用于将真实的移动轨迹转换为可控环境,用于训练和评估。MIRAGE 强调了 VLM 驱动的代理中的一个漏洞,展示了如何通过用户生成的内容实现提示注入。MobileExplorer 专注于通过并行探索 UI 元素和使用上下文提示来加速这些代理的设备上推理。M…

  18. TOOL · CL_43876 ·

    MIRAGE系统使用AI蜜罐来诱捕提示注入攻击

    MIRAGE系统不阻止提示注入攻击,而是采用蜜罐方法来欺骗攻击者。当检测到可疑提示时,MIRAGE会向攻击者提供虚假数据并记录其行为,让他们相信自己正在成功。这种方法旨在浪费攻击者的资源并收集有关其技术的情报,而不是提醒他们已被检测到。

  19. RESEARCH · CL_15798 ·

    使用多模态图像进行医学思考

    研究人员开发了MIRAGE系统,旨在通过检索和生成多模态医学图像和文本来辅助医学教育。MIRAGE利用了经过微调的CLIP模型(MedICaT-ROCO)和扩散模型(Prompt2MedImage),允许用户根据文本提示查找或创建相关图像。此外,一个大型语言模型(Dolly-v2-3b)提供了丰富的描述,并且该系统支持对不同医学状况进行视觉比较。其目标是为全球医学生提供一个免费、易于访问且交互式的学习工具,该工具完全基于公开可用的预训练模型构建。