阿里千问夺冠,GPT
11月4日,GPT备受关注的阿里AI大模型实时投资比赛“Alpha Arena”落下帷幕,阿里千问Qwen夺下最终的千问冠军。该竞赛由三方机构Nof1于10月18日发起,夺冠集合Qwen3-Max、GPTDeepSeek v3.1、阿里GPT-5、千问Gemini 2.5 Pro、夺冠Claude Sonnet 4.5、GPTGrok 4等全球六大顶尖模型,阿里每个模型拥有一万美元初始资金,千问在真实市场上无人工干预地自主决策、夺冠交易,GPT根据盈亏情况决出最后冠军。阿里历时17天,千问阿里千问Qwen以超20%的收益率夺得最后的冠军,Qwen和DeepSeek两款中国模型也成为唯二盈利的模型,而四大美国顶尖模型全部亏损,GPT-5亏损超60%垫底。

AI大模型在各种性能基准榜单中屡创新高,如何评估大模型在真实、动态、竞争激烈的环境中的决策水平,是当下AI竞技场最受人关注的领域。美国人工智能研究实验室 nof1.ai 发布的“Alpha Arena”(阿尔法竞技场),向六大顶尖模型提供1万美元及金融市场的实时价格及各类指标数据,让大模型在真实市场中用真金白银进行投资比赛,全程没有人工干预 ,模型进行自主决策和交易,是AI处理实时变动的现实世界任务的真实评测,也因此成为近期最火热的AI大赛。
比赛初期,六大模型相对谨慎,大约5天后,参赛模型大致分为三大阵营:阿里千问和DeepSeek成功领先,屡次互换第一,始终位列第一梯队;Claude Sonnet 4.5和Grok4在相近策略驱动下,维持在第二阵营,略有盈利,整体仍亏损;GPT-5、Gemini 2.5 Pro两大模型则长期亏损垫底。

截至北京时间11月4日早上比赛结束,阿里千问凭借在关键时刻的紧急避险,最后关头超越DeepSeek,Qwen以超20%的胜率问鼎冠军;DeepSeek实现盈利,位列第二,两大中国模型成为唯二仍保持正收益的大模型;Claude 4.5 Sonnet、Grok 4、Gemini 2.5 Pro和GPT-5四大海外模型均亏损,Gemini 2.5 pro和GPT-5亏损尤为明显,截至最终持仓总市值仅为初始资金的三四成。
赛事主办方Alpha Arena的创办人Jay Azhang多次为阿里千问Qwen模型策略及表现点赞,并祝贺阿里千问最终赢得冠军。有业内专家指出,阿里千问和DeepSeek在实战中的优秀表现,证明了中国模型在解决实际问题的强大潜力,AI对于场景的深刻理解,将成为大模型落地和未来全球AI竞赛的关键。
比赛链接:https://nof1.ai/
相关文章

魔怪大咖强化维生素C果味饮料,何以分食国内千亿功能饮料市场?
发布者:沛琦 浏览量:17199发布时间:2018/6/28 16:06:22 在如今功能饮料市场“百家争鸣”的竞争环境中,先来者未必能站稳脚跟,后到者也有机会冲到前面,比如2026-10-01
台股上半年暴跌市值蒸發逾10兆 國安基金宣布進場護盤|天下雜誌
台股今日大跌且成交量萎縮,國安基金今天召開臨時委員會,宣布授權執行秘書視情況動用資金執行市場安定任務。您的閱讀篇數已達上限立刻訂閱全閱讀,即可享全站不限篇數閱讀2026-10-01
玻璃隔风透光、性能稳定,各种类型由于使用场合不同而具备不同的特性,适用范围非常广。我们在挑选玻璃时,除了关注价格以外,还应对其种类和性能有一定了解,扬长避短,才能够找到更适合使用的材料。我们收集资料编2026-10-01
支持60帧光线追踪! ign发布《生化危机9》Switch2掌机模式试玩
近期,知名游戏媒体IGN发布了他们在东京电玩展上用任天堂Switch2掌机试玩《生化危机:安魂曲》的15分钟实况视频。试玩视频:由试玩画面可以看出,本作在Switch2上表现十分良好,不仅支持10802026-10-01
2018年8月17日中国玻璃综合指数1165.15点,环比上周上涨9.07点,同比去年同期上涨67.89点;中国玻璃售价趋势1193.91点,环比上周上涨7.81点,同比去年同期上涨83.67点;中国2026-10-01
玻璃的主要成分有哪些 家里的玻璃家具该怎么进行表面清洁,行业资讯
如今随着厂家生产技术不断发展,玻璃也有了各种新的种类,拥有更多更强的功能,逐渐取代普通玻璃。举例来说,原本只能透光挡风的普通玻璃窗,使用夹胶玻璃后就具备了降噪隔热的功能,更加方便实用。我们将在下文简单2026-10-01

最新评论