PulseAugur
实时 06:41:46
实体 Shard

Shard

PulseAugur coverage of Shard — every cluster mentioning Shard across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 4
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 4
层级分布 · 90 天
主题
情绪 · 30 天

2 天有情绪数据

最近 · 第 1/1 页 · 共 4 条
  1. TOOL · CL_169631 ·

    新的SHarD harness分发AI编码代理安全控制

    一篇新论文介绍了一种名为SHarD(Secure Harness Distribution)的系统,该系统旨在为AI编码代理分发安全控制。研究表明,像操作系统沙箱、技能扫描和工具限制等常见的安全措施可以有效地集成到自定义代理harness中,并通过单一安装命令部署给用户。这种方法保持了在商业代理上直接安装的安全有效性,解决了在组织中扩展代理式AI的关键障碍。

  2. TOOL · CL_175942 ·

    Hugging Face论文推出SHarD,用于分发AI代理安全控制

    Hugging Face的一篇新论文介绍了一种名为SHarD(Secure Harness Distribution)的新型代理Harness,旨在将安全控制分发给AI编码代理。SHarD已针对商业代理进行了测试,并证明了诸如操作系统沙箱、技能扫描和工具限制等安全措施可以通过单个安装命令进行有效嵌入和部署。该系统获得了完美的安全评分,其效果与安全配置的商业代理相当,并强调了系统性地分发这些控制措施以解决扩展性问题的必要性。

  3. RESEARCH · CL_115149 ·

    新的Shard方法增强了密集检索系统的隐私性

    研究人员开发了一种名为Shard的新方法,以增强密集检索系统的隐私性。密集检索系统常用于语义搜索和检索增强生成(RAG)。Shard通过引入一种保留检索的嵌入转换来解决向量存储容易受到揭示底层文本的攻击的漏洞。这种转换将嵌入分割成用于初始检索的公共前缀和在密钥下分片的私有残差,然后使用CKKS进行重新排序以取消密钥并保持精确的内积。该系统旨在防止对齐攻击和去匿名化,提供几何防御而非加密保证。

  4. RESEARCH · CL_93526 ·

    新的SHARD方法通过自重构蒸馏增强LLM的安全性与有用性 · 追踪到2个来源

    研究人员推出了一种新颖的自重构蒸馏方法SHARD,旨在增强大型语言模型在安全性和有用性方面的对齐。该技术涉及重写敏感提示以揭示良性意图,将原始响应转化为更安全、更有用的版本,然后对模型进行这些自重构输出的微调。在DNA和LINGUASAFE数据集上的实验表明,SHARD在保持安全性的同时提高了各种模型系列的有用性,并且在性能上可与来自更大教师模型的蒸馏相媲美。