PulseAugur
实时 17:11:12
实体 LLM01

LLM01

PulseAugur coverage of LLM01 — every cluster mentioning LLM01 across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 6
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

2 天有情绪数据

最近 · 第 1/1 页 · 共 8 条
  1. TOOL · CL_257938 ·

    提示注入攻击构成LLM顶级安全风险,需要外部防护栏

    提示注入攻击是生成式AI应用面临的最重大的安全风险,这一点已被OWASP大型语言模型应用十大风险所识别。这些攻击利用了LLM中指令和用户数据之间缺乏硬件级隔离的缺陷,使得攻击者能够操纵模型行为。像Maxim AI开发的AI网关Bifrost这样的解决方案,旨在通过在模型上下文窗口之外的基础设施层面实施运行时防护栏来减轻这些风险,从而在威胁到达LLM之前强制执行策略和防御威胁。

  2. TOOL · CL_215542 ·

    新指南将 sentinel-scan-cli 集成到 CI 中以捕获 LLM 提示注入

    一篇新指南详细介绍了如何将 sentinel-scan-cli 工具集成到 GitHub Actions 和 pre-commit 中,以捕获提示注入和工具投毒漏洞。该帖子强调了 CLI 中存在一个漏洞,即即使发现关键漏洞,它也会以成功代码退出。为解决此问题,提供了一个 Python 脚本,该脚本解析扫描的 JSON 输出,并在满足特定漏洞阈值时使 CI 构建失败,从而确保安全问题不会被忽视。

  3. COMMENTARY · CL_184020 ·

    提示注入模仿SQL注入但缺乏结构性修复

    提示注入是AI助手面临的重大安全风险,它通过精心设计的自然语言输入来操纵AI行为,这一点与SQL注入相似。与SQL注入可以通过参数化查询等结构性方法修复不同,提示注入利用了大型语言模型(LLMs)处理自然语言字符串的固有特性,在指令和数据之间没有清晰的架构分离。这使得模型难以区分合法命令和嵌入在用户输入或检索到的上下文中的恶意指令。安全研究人员已经发现了大量提示注入攻击的实际案例,通常使用现成的模板,这表明商品化攻击正在增长,而非复杂…

  4. TOOL · CL_158945 ·

    提示注入成为 API 团队面临的首要 LLM 安全风险

    提示注入是 API 团队面临的重大安全风险,当模型输入中的用户提供文本被误解为指令时发生。这种威胁主要有两种表现形式:API 被大型语言模型(LLM)或 AI 代理调用,以及 API 的数据被 LLM 处理。间接提示注入涉及在看似无害的数据字段中嵌入恶意指令,可能导致“被混淆的副官”问题,即代理滥用其授权的 API 访问权限。虽然目前在模型层面无法完全修复,但开发人员可以通过将所有模型输出视为不可信,并为模型输出驱动的任何特权 API…

  5. TOOL · CL_146521 ·

    LLM 提示注入防御使用独特的“金丝雀令牌”进行检测

    本文详细介绍了一种通过使用“金丝雀令牌”来检测大型语言模型 (LLM) 中提示注入攻击的方法。该方法不依赖于不可靠的正则表达式过滤器,而是将独特的、随机生成的令牌嵌入到系统提示中。然后扫描 LLM 的输出以查找这些令牌;如果检测到令牌,则表明系统提示已被泄露。该系统使用 Redis 来存储和同步多个实例之间的金丝雀令牌状态,确保检测到的泄露会触发整个应用程序的警报和令牌轮换。还提出了一种额外的“追加和剥离”变体,指示 LLM 将特定令…

  6. COMMENTARY · CL_115575 ·

    提示词注入攻击绕过人工智能防御,已瞄准90多家组织

    根据CrowdStrike发布的《2026年全球威胁报告》,提示词注入攻击日益复杂,对企业人工智能系统构成重大威胁。这些攻击绕过了传统的恶意软件防御手段,在2025年已大幅增加,瞄准了90多家组织。其漏洞根源在于人工智能模型无法区分开发者指令和用户提供的文本,从而导致凭证盗窃和数据泄露。尽管供应商付出了努力并发布了防御措施,但这些攻击仍然非常成功,一些已记录的案例即使在经过对抗性微调后,也取得了很高的成功率。

  7. TOOL · CL_17519 ·

    提示注入防御侧重于结构性保障,而非模型智能

    本文概述了防御大型语言模型中提示注入攻击的六种模式,强调防御不应依赖模型的内在智能。作者建议使用正则表达式和分类器实现“侧过滤器”,在通过电子邮件和文档等间接内容到达模型之前对其进行筛选。此外,还提出了一种工具白名单和能力令牌系统,其中模型调用工具的能力由独立的、安全的令牌发行机制控制,而不是直接的模型指令。

  8. TOOL · CL_17116 ·

    提示注入防御侧重于结构性保障,而非模型智能

    本文概述了防御大型语言模型中提示注入攻击的六种模式,并强调防御不应依赖模型的内在智能。作者建议在间接内容源(如电子邮件或文档)到达模型之前,使用正则表达式和分类器实现“侧过滤器”。此外,还提出了一种工具白名单和能力令牌系统,其中运行时而非模型,根据经过身份验证的用户会话授予工具使用权限。