阿里千问夺冠,GPT
11月4日,GPT备受关注的阿里AI大模型实时投资比赛“Alpha Arena”落下帷幕,阿里千问Qwen夺下最终的千问冠军。该竞赛由三方机构Nof1于10月18日发起,夺冠集合Qwen3-Max、GPTDeepSeek v3.1、阿里GPT-5、千问Gemini 2.5 Pro、夺冠Claude Sonnet 4.5、GPTGrok 4等全球六大顶尖模型,阿里每个模型拥有一万美元初始资金,千问在真实市场上无人工干预地自主决策、夺冠交易,GPT根据盈亏情况决出最后冠军。阿里历时17天,千问阿里千问Qwen以超20%的收益率夺得最后的冠军,Qwen和DeepSeek两款中国模型也成为唯二盈利的模型,而四大美国顶尖模型全部亏损,GPT-5亏损超60%垫底。

AI大模型在各种性能基准榜单中屡创新高,如何评估大模型在真实、动态、竞争激烈的环境中的决策水平,是当下AI竞技场最受人关注的领域。美国人工智能研究实验室 nof1.ai 发布的“Alpha Arena”(阿尔法竞技场),向六大顶尖模型提供1万美元及金融市场的实时价格及各类指标数据,让大模型在真实市场中用真金白银进行投资比赛,全程没有人工干预 ,模型进行自主决策和交易,是AI处理实时变动的现实世界任务的真实评测,也因此成为近期最火热的AI大赛。
比赛初期,六大模型相对谨慎,大约5天后,参赛模型大致分为三大阵营:阿里千问和DeepSeek成功领先,屡次互换第一,始终位列第一梯队;Claude Sonnet 4.5和Grok4在相近策略驱动下,维持在第二阵营,略有盈利,整体仍亏损;GPT-5、Gemini 2.5 Pro两大模型则长期亏损垫底。

截至北京时间11月4日早上比赛结束,阿里千问凭借在关键时刻的紧急避险,最后关头超越DeepSeek,Qwen以超20%的胜率问鼎冠军;DeepSeek实现盈利,位列第二,两大中国模型成为唯二仍保持正收益的大模型;Claude 4.5 Sonnet、Grok 4、Gemini 2.5 Pro和GPT-5四大海外模型均亏损,Gemini 2.5 pro和GPT-5亏损尤为明显,截至最终持仓总市值仅为初始资金的三四成。
赛事主办方Alpha Arena的创办人Jay Azhang多次为阿里千问Qwen模型策略及表现点赞,并祝贺阿里千问最终赢得冠军。有业内专家指出,阿里千问和DeepSeek在实战中的优秀表现,证明了中国模型在解决实际问题的强大潜力,AI对于场景的深刻理解,将成为大模型落地和未来全球AI竞赛的关键。
比赛链接:https://nof1.ai/
- ·“具身智能时代”快到了?丨科创要闻
- ·福耀集团在广州等地建立现代化生产基地,图片新闻
- ·香港储蓄险可靠公司推荐:安达人寿、友邦保险等险企综合对比
- ·礼来150周年庆典恰逢上海乒乓热,以运动精神赋能健康未来【健康】风尚中国网
- ·《心之眼》开发商遭员工起诉:偷装侵入式监控软件
- ·川妹子回家机票丢了 民警连夜找的哥帮送回
- ·英伟达员工晒年会最牛年终奖:黄仁勋亲笔签名皮衣
- ·滴滴通报上半年反舞弊情况:50余人因触犯高压线政策被解除或清退,40余人因涉嫌违法犯罪被移送公安机关处理
- ·31岁重疾险多少钱?31岁重疾险多少钱1年?
- ·Steam成人向恐怖游戏《罪之尖塔》引关注 还有可爱妹妹
- ·香港有哪些比较好的保险?——一份基于渠道维度的市场竞争分析报告
- ·对抗内存涨价要靠微软 网友呼吁Win11优化内存占用
- ·孩子重疾险有必要买吗?给孩子的重疾险有没有必要买
- ·师徒三人专打挖掘机主板主意 不到半月盗窃4起
- ·2026年家财险最权威全维度品质+口碑推荐选择评测百强前五榜单已出炉
- ·植物蛋白饮料市场超级火爆,绿岭核桃乳强势入局,现在知道不算太晚!
- ·猫眼娱乐成首批接入微信AI生态团队,打造智能化票务新体验
- ·滴滴通报上半年反舞弊情况:50余人因触犯高压线政策被解除或清退,40余人因涉嫌违法犯罪被移送公安机关处理
- ·Netflix购得《高达》真人版改编权 主演或已确认
- ·千年陶罐养兰花 泉州晋江迎春花市开启
- ·2018年8月17日浮法玻璃产能利用率,产业数据
- ·轻松占市场,收入翻几倍!三诺葡萄糖补水液,带你见证爆品的力量!
- ·保障再升级,覆盖更全面:人保健康好医保・长期医疗险(旗舰版2025)产品介绍
- ·利率下行时代怎么选,新华快享福5号给出稳健答案
- ·100种重疾险需要买?重疾险100种重疾包含哪些?
- ·英媒称中国产卡通玻璃杯含铅量超标1000倍,图片新闻
