实体
Guise
Guise
PulseAugur coverage of Guise — every cluster mentioning Guise across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
新的基准GUISE揭示大语言模型对叙事包装的脆弱性
一项新的研究论文介绍GUISE,这是一个旨在评估大型语言模型(LLM)在嵌入叙事包装时有效拒绝有害请求能力的基准。研究发现,像Qwen3-1.7B这样的模型极易受到这些包装的影响,在不同语言和语域下的拒绝率显著下降。为了解决这一脆弱性,研究人员开发了AXIS,一种结合了偏好优化和目标对齐的防御机制,将有害请求的表示与拒绝方向对齐,并确保完全拒绝,在Qwen3-1.7B、Qwen3-4B和GLM-4-9B上实现了高安全性和可用性得分。
-
大型语言模型在测试终端用户界面方面展现出潜力
研究人员开发了一种使用大型语言模型(LLM)测试终端用户界面(TUI)的新方法。对197个TUI应用程序的调查显示,大多数现有测试未能有效运行界面。该研究创建了一个基准,使用Rust、Go、Python和TypeScript中的TUI应用程序的Docker镜像,并将LLM与随机探索进行比较。虽然没有单一的LLM表现优于其他模型,但LLM指导在每次交互中效率更高,发现了随机探索遗漏的故障。研究还强调,自动生成启动输入可显著提高测试有效性…