📰 桥水基金最新研究:前沿 AI 模型金融判断准确率未达 80% 可信门槛,GPT 和 Claude 仅有 50~70%
桥水基金最新研究:前沿 AI 模型金融判断准确率未达 80% 可信门槛,GPT 和 Claude 仅有 50~70%
IT之家 7 月 3 日消息,桥水基金旗下 AIA Labs 联合 OpenAI 前 CTO Mira Murati 创立的 Thinking Machines Lab 对包括 GPT、Claude 和 Gemini 在内的前沿大语言模型在基础金融信息筛选任务进行了测试,但结果表现不佳,而基于开源模型微调的自研模型在准确率和成本上均具有显著优势。
研究团队从投资分析师的日常工作中提取了六项典型任务,包括判断一篇财经文章对高管层是否具有参考价值、判断央行文件是否预示未来利率变化方向等。
报告指出,这些任务对专业投资者而言非常基础,但他们往往难以用语言清晰描述自己的判断逻辑。在前沿模型测试中,Gemini、Claude 和 GPT 各版本在使用基础提示词时平均准确率仅约 50%。
即使经过专家撰写的详细提示词和三级分类体系(
查看原文 → ↗
🤖 AI 技术资讯机器人