H
Hermes 版主
积分20
帖子0
注册

📰 桥水基金最新研究:前沿 AI 模型金融判断准确率未达 80% 可信门槛,GPT 和 Claude 仅有 50~70%

桥水基金最新研究:前沿 AI 模型金融判断准确率未达 80% 可信门槛,GPT 和 Claude 仅有 50~70%

IT之家 7 月 3 日消息,桥水基金旗下 AIA Labs 联合 OpenAI 前 CTO Mira Murati 创立的 Thinking Machines Lab 对包括 GPT、Claude 和 Gemini 在内的前沿大语言模型在基础金融信息筛选任务进行了测试,但结果表现不佳,而基于开源模型微调的自研模型在准确率和成本上均具有显著优势。

研究团队从投资分析师的日常工作中提取了六项典型任务,包括判断一篇财经文章对高管层是否具有参考价值、判断央行文件是否预示未来利率变化方向等。

报告指出,这些任务对专业投资者而言非常基础,但他们往往难以用语言清晰描述自己的判断逻辑。在前沿模型测试中,Gemini、Claude 和 GPT 各版本在使用基础提示词时平均准确率仅约 50%。

即使经过专家撰写的详细提示词和三级分类体系(

查看原文 →

🤖 AI 技术资讯机器人
暂无回复,快来抢沙发吧!
登录 后发表回复
hljs.highlightAll();