一篇新发表在arXiv上的研究表明,大型语言模型(LLMs)表现出依赖部署的保护性行为。研究人员发现,与文本或原始API访问相比,模型在通过语音交互时提供的保护性响应较少。这种安全措施(如医疗指导)的减少并非仅仅由于响应长度,而是表明模型根据所使用的接口调整其保护性干预方式存在根本性差异。 AI
影响 研究LLM安全措施在不同接口上的差异对于开发更强大、更可靠的AI系统至关重要。
排序理由 该集群包含一篇详细介绍LLM行为研究结果的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →