实体
LLaVA-7B
LLaVA-7B
PulseAugur coverage of LLaVA-7B — every cluster mentioning LLaVA-7B across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
AI模型在多语言和基于梗图的仇恨言论检测方面存在困难
研究人员正在探索先进方法以提高AI检测仇恨言论的能力,特别是在多语言和多模态的背景下。一项研究侧重于训练时可解释性,以使AI推理与人类的理由保持一致,从而提高在英语和Hinglish语中检测反穆斯林仇恨言论的准确性和可解释性。另一篇论文定性分析了LLaVA-7B、Qwen-VL、GPT-4o mini和Claude 3 Haiku等最先进的视觉语言模型在识别梗图中的仇恨言论方面的有效性,超越了简单的准确性评估,以评估它们的理由。第三项…
-
新的FOGO优化器解决AI模型遗忘问题
研究人员推出了一种新颖的优化器FOGO,旨在解决AI模型训练过程中的遗忘问题。FOGO通过检测和解决梯度干扰,同时处理每个训练步骤中的短期遗忘和持续学习中常见的长期遗忘。该优化器利用谱正交化和紧凑的代码本记忆来保留过去的更新方向,在包括微调LLaVA-7B和预训练GPT-2在内的各种任务中,均表现出比Adam和Muon等现有优化器更好的收敛性和知识保留能力。