实体
resklogits
resklogits
PulseAugur coverage of resklogits — every cluster mentioning resklogits across labs, papers, and developer communities, ranked by signal.
总计 · 30天
3
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 3 条
-
新的 Python 包 reskSecure 可作为 LLM 防火墙阻止越狱
一个名为 reskSecure 的新 Python 包已被开发出来,用作大型语言模型 (LLM) 的防火墙,旨在防止越狱和提示注入。与依赖提示工程或后生成过滤的传统方法不同,reskSecure 直接干预模型的 token 生成循环。它利用一个 64 位权限位掩码来控制 LLM 被允许输出的内容,将 logits 设置为负无穷以进行硬性阻止或对偏差应用惩罚,从而增强安全性。
-
Resk 发布自托管 LLM 防火墙,增强安全性
Resk 发布了一款自托管 LLM 防火墙,旨在增强 OpenAI 兼容提供商的安全性。该防火墙使用 FastAPI 和 React 构建,通过实施强大的身份验证、具有能力位掩码的角色访问控制 (RBAC) 以及可定制的过滤策略,解决了提示注入、数据泄露和未经授权访问等风险。该系统可以通过 resklogits 在 logits 级别强制执行策略,提供比传统输入/输出过滤更高级别的防御。
-
新库将 GPU 加速的惩罚应用于 LLM logits 以增强安全性
一个名为 ReskLogits 的新开源库已被开发出来,通过在 token 采样发生之前的 logits 层面进行干预来增强 LLM 的安全性。这种方法旨在通过实时对危险 token 应用惩罚来防止有害内容的生成,从而使攻击者更难利用提示注入漏洞。该库提供了一个 GPU 加速的 Aho-Corasick 算法,用于高效的模式匹配,并支持多级过滤,允许根据禁用短语的严重程度进行可配置的惩罚。