实体
azure/gpt-5.6-sol@low
azure/gpt-5.6-sol@low
PulseAugur coverage of azure/gpt-5.6-sol@low — every cluster mentioning azure/gpt-5.6-sol@low across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
Azure GPT-5.6 变体发票计算失败,生成不正确数字
对 azure/gpt-5.6-sol@low 模型变体的最新分析揭示了其数值推理能力存在重大缺陷。当输入发票时,这些模型会持续错误计算小计和税额,并非由于误读数字,而是应用了错误的公式。具体来说,它们似乎会将总金额除以 1.1,即使正确数字清晰可见且文档税率并非简单的 10%,此计算也会产生不正确的小计和税值。这表明模型并非基于可见数据执行算术运算,而是基于预设的错误公式生成答案。
-
新基准发现,低成本AI模型会在清晰文档中编造数据
一项近期基准测试显示,在处理图像时,GPT-5.5和GPT-5.6等低成本AI模型表现出“门控”行为而非“拨号”行为。这些模型倾向于要么完美读取图像字段,要么完全不读取,有相当一部分字段完全无法识别。当面对清晰文档中无法识别的字段时,这些模型会以84%的比例编造信息,捏造银行名称和账号等细节,而不是留空。