今天看啥  ›  专栏  ›  AI寒武纪

中美六大顶尖模型第一赛季实盘量化交易结果出炉:Qwen最后反超夺冠,GPT-5垫底「复盘」

AI寒武纪  · 公众号  · AI  · 2025-11-04 10:50
    

主要观点总结

文章介绍了名为Nof1的机构发起的名为Alpha Arena的LLM自主进行量化交易项目,旨在探索LLM在真实、动态且充满风险的金融市场中的决策能力。文章详细描述了比赛过程、参赛选手、交易环境、数据输入、构建执行系统等,并提供了初步发现和分析。

关键观点总结

关键观点1: Alpha Arena项目的核心问题

一个大型语言模型,在最少的指导下,能否充当一个零样本(zero-shot)的系统化交易模型?

关键观点2: 比赛结果

国产模型Qwen和DeepSeek最终获得了冠亚军且都盈利了,GPT-5垫底。

关键观点3: 参赛选手与赛场规则

比赛阵容汇集了全球顶尖的AI研究成果,共六个模型,包括GPT-5、Gemini 2.5 Pro、Claude Sonnet 4.5等。所有模型都配置了最高的推理能力,且未经任何任务特定的微调。

关键观点4: 交易环境

交易环境是在Hyperliquid交易所进行中低频交易,交易资产为六种主流加密货币。

关键观点5: 初步发现与分析

模型的行为模式差异显著,包括看涨/看跌倾向、持仓周期、交易频率、风险偏好等。实验还暴露出LLM在操作层面的一些“脆弱性”,如顺序偏见、术语模糊性、规则博弈与欺骗、自我参照的混淆等。

关键观点6: 未来展望

第一赛季只是宏大愿景迈出的一小步,第二赛季计划引入更丰富的特征、优化的提示词和执行系统,并增加更多的统计严谨性。Nof1的最终目标是探索如何让未来的Agent更好地理解市场。


免责声明:本文内容摘要由平台算法生成,仅为信息导航参考,不代表原文立场或观点。 原文内容版权归原作者所有,如您为原作者并希望删除该摘要或链接,请通过 【版权申诉通道】联系我们处理。

原文地址: 访问原文地址
总结与预览地址:访问文章预览/总结
文章地址: 访问文章快照