一个名为 reskSecure 的新 Python 包已被开发出来,用作大型语言模型 (LLM) 的防火墙,旨在防止越狱和提示注入。与依赖提示工程或后生成过滤的传统方法不同,reskSecure 直接干预模型的 token 生成循环。它利用一个 64 位权限位掩码来控制 LLM 被允许输出的内容,将 logits 设置为负无穷以进行硬性阻止或对偏差应用惩罚,从而增强安全性。 AI
影响 该工具可以通过防止未经授权的操作和数据泄露,显著提高 LLM 应用程序的安全性。
排序理由 该项目描述了一个增强 LLM 安全性的新软件包,符合工具的定义。
- Aho–Corasick algorithm
- AutoModelForCausalLM
- AutoTokenizer
- Bitmask
- mistralai/Mistral-7B-v0.1
- Python
- resklogits
- reskSecure
- transformers
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →