实体
Beatriz
Beatriz
PulseAugur coverage of Beatriz — every cluster mentioning Beatriz across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天
2 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
独立AI研究员开发零成本认知门控以对抗LLM操纵
一位独立研究员详细介绍了一个零成本项目,旨在为大型语言模型开发认知门控,以防止操纵并确保事实准确性。面对硬件限制,该研究员在个人笔记本电脑和Kaggle的免费T4 GPU上进行了16次实验,重点关注GPT-2 124M和Phi-3-mini 3.8B等较小模型。该项目名为BEATRIZ,在防止数据投毒方面保持模型完整性方面取得了显著成果,最新迭代在低延迟下实现了93%的精确率和80%的召回率。
-
作者在为期17天的项目中开发LLM数据投毒防御机制
作者详细介绍了一个为期17天的项目,旨在构建一个“认知门控”(epistemic gate),以防止在LLM微调过程中发生数据投毒。该项目命名为EXP01-07,涉及开发一种新颖的损失函数,该函数相对于真实情况来惩罚虚假信息,而不是绝对惩罚,以避免发散。它还将门控机制从简单的字典查找过渡到几何嵌入,并利用了真实世界事实的语料库。该项目的架构最初受到一个bug的阻碍,后来被正确实现并命名为“Beatriz”。