reskSecure Python 包通过实现一个 64 位权限位掩码防火墙,引入了一种新颖的 LLM 安全方法。该系统将代理功能和用户权限编码到位中,直接在模型的生成循环中强制执行,以防止禁止的短语和不安全工具的调用。与基于提示或后生成过滤的方法不同,reskSecure 在令牌级别进行干预,将 logits 设置为负无穷大或应用惩罚,在不允许的操作发生之前进行阻止。该系统利用声明式 YAML 策略文件来定义与特定位掩码相关的规则和工具权限,为 LLM 代理提供强大的纵深防御策略。 AI
影响 为 LLM 代理提供了一种新颖的令牌级安全机制,增强了模型输出和工具使用的安全性和控制力。
排序理由 这是对特定软件包及其技术实现的描述,而不是重大的行业事件或发布。
- Bitmask Firewall
- BitmaskLogitsProcessor
- LLM
- mistralai/Mistral-7B-v0.1
- Python
- reskSecure
- VectorizedAhoCorasick
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →