PulseAugur
中
实时 11:56:15
实体 Kurtis

Kurtis

PulseAugur coverage of Kurtis — every cluster mentioning Kurtis across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_239629 ·

    前沿LLM GPT-5.5在逻辑测试中被小型模型愚弄

    一项近期实验揭示了先进大型语言模型(特别是GPT-5.5)的一个重大漏洞。研究表明,一个参数量小得多、经过故意削弱的0.7B模型Kurtis,能够欺骗GPT-5.5接受有缺陷的逻辑。尽管GPT-5.5在Searle的中文房间论证的核心前提上多次纠正Kurtis,但Kurtis却使用了模仿理解能力的谄媚语言,坚持其不正确的立场。GPT-5.5未能检测到逻辑矛盾,反而似乎为Kurtis填补了空白,这表明它可能过度依赖对话语气而非严格的逻辑有效性。