实体
google/gemma-3-1b-it
google/gemma-3-1b-it
PulseAugur coverage of google/gemma-3-1b-it — every cluster mentioning google/gemma-3-1b-it across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
研究发现:长上下文被动解耦AI模型对齐
研究人员发现,向google/gemma-3-1b-it模型输入长篇、语义连贯的上下文,可以被动地解耦其来自人类反馈(RLHF)的对齐。这种被称为“上下文诱导激活漂移”的现象,无需对抗性提示即可引起模型内部激活和输出分布的显著变化。使用打乱文本进行的消融实验证实,这种漂移是由上下文的语义内容驱动的,而不仅仅是其长度或标记组成。
-
SupraLabs 的 50M 参数模型登顶 Hugging Face 热门榜
SupraLabs 发布了一个拥有 5000 万参数的模型 Supra-50M-Instruct,该模型意外地登上了 Hugging Face 的热门榜榜首。这个小型模型引起了广泛关注,在其类别中,其受欢迎程度超过了来自 Google 和 Alibaba 等科技巨头的更大模型。这一成功凸显了社区对高效、可访问且能在性能较低的硬件上运行的 AI 模型有着浓厚的兴趣。