阿里千问夺冠,GPT
11月4日,GPT备受关注的阿里AI大模型实时投资比赛“Alpha Arena”落下帷幕,阿里千问Qwen夺下最终的千问冠军。该竞赛由三方机构Nof1于10月18日发起,夺冠集合Qwen3-Max、GPTDeepSeek v3.1、阿里GPT-5、千问Gemini 2.5 Pro、夺冠Claude Sonnet 4.5、GPTGrok 4等全球六大顶尖模型,阿里每个模型拥有一万美元初始资金,千问在真实市场上无人工干预地自主决策、夺冠交易,GPT根据盈亏情况决出最后冠军。阿里历时17天,千问阿里千问Qwen以超20%的收益率夺得最后的冠军,Qwen和DeepSeek两款中国模型也成为唯二盈利的模型,而四大美国顶尖模型全部亏损,GPT-5亏损超60%垫底。

AI大模型在各种性能基准榜单中屡创新高,如何评估大模型在真实、动态、竞争激烈的环境中的决策水平,是当下AI竞技场最受人关注的领域。美国人工智能研究实验室 nof1.ai 发布的“Alpha Arena”(阿尔法竞技场),向六大顶尖模型提供1万美元及金融市场的实时价格及各类指标数据,让大模型在真实市场中用真金白银进行投资比赛,全程没有人工干预 ,模型进行自主决策和交易,是AI处理实时变动的现实世界任务的真实评测,也因此成为近期最火热的AI大赛。
比赛初期,六大模型相对谨慎,大约5天后,参赛模型大致分为三大阵营:阿里千问和DeepSeek成功领先,屡次互换第一,始终位列第一梯队;Claude Sonnet 4.5和Grok4在相近策略驱动下,维持在第二阵营,略有盈利,整体仍亏损;GPT-5、Gemini 2.5 Pro两大模型则长期亏损垫底。

截至北京时间11月4日早上比赛结束,阿里千问凭借在关键时刻的紧急避险,最后关头超越DeepSeek,Qwen以超20%的胜率问鼎冠军;DeepSeek实现盈利,位列第二,两大中国模型成为唯二仍保持正收益的大模型;Claude 4.5 Sonnet、Grok 4、Gemini 2.5 Pro和GPT-5四大海外模型均亏损,Gemini 2.5 pro和GPT-5亏损尤为明显,截至最终持仓总市值仅为初始资金的三四成。
赛事主办方Alpha Arena的创办人Jay Azhang多次为阿里千问Qwen模型策略及表现点赞,并祝贺阿里千问最终赢得冠军。有业内专家指出,阿里千问和DeepSeek在实战中的优秀表现,证明了中国模型在解决实际问题的强大潜力,AI对于场景的深刻理解,将成为大模型落地和未来全球AI竞赛的关键。
比赛链接:https://nof1.ai/
- ·玻璃从区域看北方地区真的要好过南方地区吗?,行业资讯
- ·泉州南环路主路沥青基本铺完 春节前有望全线通车
- ·华西地区至黄淮一带将有强降雨
- ·45岁重疾险一年多少钱,45岁重疾险一年多少钱一个月
- ·绿色建筑新宠“Low
- ·泉州市国家水利风景区增至6家
- ·李艺彤集资破记录是怎么回事?李艺彤近照曝光个人资料介绍
- ·慰问加“净走” 厦门思明这个小区的母亲节很特别
- ·中我国窗标杆品牌 中国十大玻璃制造业,行业资讯
- ·郑州48条公交线路今起加密车次 绿色出行迎盛会
- ·伦纳德31分加索尔22+9+6 马刺大胜送湖人2连败
- ·2019年1月1日至1月3日泉州市暂停医保刷卡结算服务
- ·市卫健委持续提升医疗服务质效_
- ·中舒建设领导陪同贺州城投集团领导视察项目
- ·机场高速将开启双向8车道时代 上周已开始转换
- ·讓蔡明忠辭金控副董 顧立雄:說每個職位沒你不行,沒說服力!|天下雜誌
- ·把课堂搬到床头 用爱心叩开心门_
- ·郑州48条公交线路今起加密车次 绿色出行迎盛会
- ·景区无人售卖机旅游纪念品卖得火 将在全国布设2000台
- ·AI浪潮來襲 掌握投資3趨勢 當AI能聽會說、能看會辨、能想會懂,你想被擊倒?或踏上浪尖?|天下雜誌
- ·华尔街实测8款全球主流Agent:千问办公综合排名第一,超Claude Cowork、Codex
- ·健康保险品牌排行榜,健康保险品牌排行榜最新
- ·伦纳德31分加索尔22+9+6 马刺大胜送湖人2连败
- ·东方神起雨中表演零失误!网友评论炸了:常青树组合不是没有原因的
- ·人寿团体意外险赔偿标准,人寿团体意外伤残赔付标准
- ·安东尼斗气单挑55秒飙7分 末节关键3分杀死比赛
