PulseAugur
中
实时 05:03:18
实体 mistralai/Mistral-7B-v0.1

mistralai/Mistral-7B-v0.1

PulseAugur coverage of mistralai/Mistral-7B-v0.1 — every cluster mentioning mistralai/Mistral-7B-v0.1 across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
3
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 3 条
  1. TOOL · CL_249957 ·

    reskSecure 推出位掩码防火墙以实现 LLM 访问控制

    reskSecure Python 包通过实现一个 64 位权限位掩码防火墙,引入了一种新颖的 LLM 安全方法。该系统将代理功能和用户权限编码到位中,直接在模型的生成循环中强制执行,以防止禁止的短语和不安全工具的调用。与基于提示或后生成过滤的方法不同,reskSecure 在令牌级别进行干预,将 logits 设置为负无穷大或应用惩罚,在不允许的操作发生之前进行阻止。该系统利用声明式 YAML 策略文件来定义与特定位掩码相关的规则和…

  2. TOOL · CL_249825 ·

    新的 Python 包 reskSecure 可作为 LLM 防火墙阻止越狱

    一个名为 reskSecure 的新 Python 包已被开发出来,用作大型语言模型 (LLM) 的防火墙,旨在防止越狱和提示注入。与依赖提示工程或后生成过滤的传统方法不同,reskSecure 直接干预模型的 token 生成循环。它利用一个 64 位权限位掩码来控制 LLM 被允许输出的内容,将 logits 设置为负无穷以进行硬性阻止或对偏差应用惩罚,从而增强安全性。

  3. TOOL · CL_124855 ·

    新的开源工具在 Logits 层过滤 LLM 越狱

    Resk-Security 发布了 resk-logits,一个开源的 Python 库,旨在通过在 Logits 层进行过滤来防止大型语言模型 (LLM) 越狱。这种方法在有害 token 生成之前进行拦截,不同于传统的在生成后扫描输出的方法。该库利用 GPU 加速的 Aho-Corasick 算法,在一毫秒内扫描超过 10,000 个不允许的模式,为 LLM 安全提供了更强大、更快速的方法。