欧洲新闻网 | 中国 | 国际 | 社会 | 娱乐 | 时尚 | 民生 | 科技 | 旅游 | 体育 | 财经 | 健康 | 文化 | 艺术 | 人物 | 家居 | 公益 | 视频 | 华人 | 闽东之光
投稿邮箱:uscntv@outlook.com
主页 > 财经 > 商贸 > 正文

六大AI模型被扔进加密市场厮杀,DeepSeek暂为交易之王

2025-10-21 09:52 华尔街见闻  -  227110

全球六大主流大语言模型(LLM)各发1万美元,丢进同一真实市场实盘厮杀,会发生什么?

上周六(10月18日),美国人工智能研究实验室nof1.ai在其“Alpha Arena”(阿尔法竞技场)平台上举办了一场活动——给六个顶级模型一万美元的真金白银,让它们下场交易,而且并非模拟盘,真金白银地交易。

这六大模型分别为Anthropic的Claude 4.5 Sonnet、深度求索的DeepSeek V3.1 Chat、谷歌的Gemini 2.5 Pro、OpenAI的GPT 5、xAI的Grok 4和阿里通义的Qwen 3 Max。

测试规则写道,每个模型获得10,000美元的“真实资本”,在交易所Hyperliquid上,以相同提示词与输入数据条件下,交易加密货币的永续合约。所有的对话都在nof1.ai网站上公开可见。

规则称,比赛的目标是“将风险调整后的收益最大化”:“每个人工智能(AI)模型必须自行产生Alpha(超额收益)、确定仓位、择时交易并管理风险”。

系统会告诉AI模型当前的时间、账户信息、持仓情况,然后附上实时价格、指标等数据。 然后,要求模型做出决策:如果持有仓位,是继续持有还是平仓;如果空仓,是买入还是继续观望。

经过近60小时的激战后,截至北京时间周一(10月20日)17:18,DeepSeek的持仓总市值接近1.4万美元,收益率约40%,最高时一度接近1.5万美元,是当前表现最好的模型。

 

Grok 4实力次之,目前持仓总市值在1.33万美元附近。具体来看,DeepSeek和Grok 4都依靠做多比特币和以太坊获利。

Claude主要交易瑞波币和以太坊,Qwen则专注于以太坊,两者收益位列三四,但也整体跑赢比特币现货的走势。

与之相比,GPT 5和Gemini已出现了明显亏损,目前持仓总市值分别为7300美元和6900美元,意味着两个模型已亏损约2700和3100美元,表现最差。

nof1.ai表示,进行这一竞赛是为了是让基准测试更贴近真实世界,而金融市场是最理想的试炼场,因为这类市场具有动态性、对抗性、开放性与高度不可预测性。

“这些特质能以静态测试无法企及的方式,真正挑战人工智能,”nof1.ai没有提到本次竞赛的结束时间,只写道“第一季将运行数周,随后推出重大更新的第二季”。

有分析认为,市场早已期待在DeFAI(DeFi + AI)方向上出现杀手级应用,让LLM参与链上博弈有很大的想象空间。

  声明:文章大多转自网络,旨在更广泛的传播。本文仅代表作者个人观点,与美国新闻网无关。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。如有稿件内容、版权等问题请联系删除。联系邮箱:uscntv@outlook.com。

上一篇:甲骨文持续“画饼”,华尔街出现分歧:需要用实际业绩证明估值
下一篇:越南再爆“数万亿”地产大雷,股市重挫5%,创六个月来最大单日跌幅

热点新闻

重要通知

服务之窗

关于我们| 联系我们| 广告服务| 供稿服务| 法律声明| 招聘信息| 网站地图

本网站所刊载信息,不代表美国新闻网的立场和观点。 刊用本网站稿件,务经书面授权。

美国新闻网由欧洲华文电视台美国站主办 www.uscntv.com

[部分稿件来源于网络,如有侵权请及时联系我们] [邮箱:uscntv@outlook.com]