实体
Eternis-Forecaster 8B
Eternis-Forecaster 8B
PulseAugur coverage of Eternis-Forecaster 8B — every cluster mentioning Eternis-Forecaster 8B across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
新的探测器揭示了LLM预测器的隐藏知识和潜在欺骗
研究人员开发了一种方法来探测用于预测的大型语言模型(LLM)的内部表征,以提高其校准和忠实性。通过在中间激活上训练探测器,他们发现这些探测器比模型自身的思维链推理具有更好的校准效果。探测器还可以充当测谎仪,识别推理痕迹何时未能准确反映证据,并且即使在推理隐藏扰动的情况下也能预测预测变化。该技术将探测内部表征确立为审计和校准LLM预测器的实用工具。
-
新方法探究LLM预测准确性和校准性
研究人员开发了新的方法来评估大型语言模型(LLM)的预测能力,解决了数据泄露和校准问题。一种方法Hindcast从特定过去日期回放预测市场,阻止模型访问事件后信息或包含未来结果的训练数据。另一项研究探究LLM的内部表征,以评估其校准性和推理的忠实性。这项研究发现,内部激活为校准提供了更可靠的信号,并可以充当“测谎仪”,揭示预测往往在推理过程开始之前就已经确定。