Resk-Security 发布了 reskSecure,这是一款新的开源工具,旨在通过在 token 生成前的 logits 层面进行过滤来增强大语言模型(LLM)的安全性。这种预防性方法旨在阻止有害 token 被采样,不同于在生成后过滤输出的传统方法。该工具利用能力位掩码系统,根据用户定义的策略对特定 token 进行惩罚或阻止,提供 HARD(无法生成)和 BIAS(可配置惩罚)等模式。reskSecure 可以集成到 Python 应用程序中,并支持策略文件的热重载以实现持续安全。 AI
影响 通过防止有害 token 生成来增强大语言模型的安全性,可能降低 AI 应用中的风险。
排序理由 该集群描述了一个用于大语言模型安全的新开源工具的发布。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →