研究人员开发了 FIDES,一个旨在衡量 LLM 生成交易策略保真度的新协议。该协议将自然语言理由、可执行实现和由此产生的业绩记录视为必须协调的三个不同视图。实验表明,这些视图之间的一致性并不能预测盈利能力,大多数 LLM 策略未能跑赢简单的买入并持有规则,而且 LLM 经常错误地校准其自我评估。 AI
影响 引入了一种评估 LLM 生成输出可靠性的方法,有可能提高其在金融交易等敏感应用中的使用。
排序理由 该集群描述了在学术论文中提出的一种新的测量协议。
在 Hugging Face Daily Papers 阅读 →
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →