一项新研究对几种大语言模型(LLMs)在金融情绪分类和收益率可预测性方面的有效性进行了基准测试。研究人员发现,尽管Mistral-7B和QLoRA适配的Qwen2.5-7B等模型在分类任务中取得了高准确率,但在经过严格校正后,它们预测股市回报的能力微乎其微且不具有统计学意义。研究结果突显了金融应用中语言表现与实际经济效用之间存在的显著差距。 AI
影响 强调了当前大语言模型在将分类准确率转化为现实世界金融预测方面的局限性,表明需要进一步研究以实现经济效用。
排序理由 详细介绍大语言模型在金融任务中表现的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →