当前位置:首页 > Deepseek最新资讯 > 正文内容

全球首个AI投资大赛揭晓,阿里千问拿下第一,DeepSeek第二,GPT-5垫底

10个月前 (11-05)Deepseek最新资讯273

  最会赚钱的两个AI全部来自杭州:阿里千问Qwen以超20%的胜率夺冠,实现盈利的DeepSeek位列第二。而GPT-5亏损超60%垫底。

  该竞赛由三方机构Nof1于10月18日发起,集合Qwen3-Max、DeepSeek v3.1、GPT-5、Gemini 2.5 Pro、Claude Sonnet 4.5、Grok 4等全球六大顶尖模型,每个模型拥有一万美元初始资金deepseek,在真实市场上无人工干预地自主决策、交易,根据盈亏情况决出最后冠军。

  历时17天,阿里千问Qwen以超20%的收益率夺得最后的冠军,Qwen和DeepSeek两款中国模型也成为唯二盈利的模型,而四大美国顶尖模型全部亏损,GPT-5亏损超60%垫底。

  AI大模型在各种性能基准榜单中屡创新高,如何评估大模型在真实、动态、竞争激烈的环境中的决策水平,是当下AI竞技场最受人关注的领域。

  美国人工智能研究实验室 nof1.ai 发布的“Alpha Arena”(阿尔法竞技场),向六大顶尖模型提供1万美元及金融市场的实时价格及各类指标数据,让大模型在真实市场中用真金白银进行投资比赛,全程没有人工干预 ,模型进行自主决策和交易,是AI处理实时变动的现实世界任务的真实评测,也因此成为近期最火热的AI大赛。

  比赛初期,六大模型相对谨慎,大约5天后,参赛模型大致分为三大阵营:阿里千问和DeepSeek成功领先,屡次互换第一,始终位列第一梯队;Claude Sonnet 4.5和Grok4在相近策略驱动下,维持在第二阵营,略有盈利,整体仍亏损;GPT-5、Gemini 2.5 Pro两大模型则长期亏损垫底。

  截至北京时间11月4日早上比赛结束,阿里千问凭借在关键时刻的紧急避险,最后关头超越DeepSeek,Qwen以超20%的胜率问鼎冠军;DeepSeek实现盈利,位列第二,两大中国模型成为唯二仍保持正收益的大模型。

  赛事主办方Alpha Arena的创办人Jay Azhang多次为阿里千问Qwen模型策略及表现点赞,并祝贺阿里千问最终赢得冠军。有业内专家指出,阿里千问和DeepSeek在实战中的优秀表现,证明了中国模型在解决实际问题的强大潜力,AI对于场景的深刻理解,将成为大模型落地和未来全球AI竞赛的关键。原文出处:全球首个AI投资大赛揭晓,阿里千问拿下第一,DeepSeek第二,GPT-5垫底,感谢原作者,侵权必删!

标签: deepseek

“全球首个AI投资大赛揭晓,阿里千问拿下第一,DeepSeek第二,GPT-5垫底” 的相关文章

DeepSeek预测:比利亚雷亚尔vs西班牙人!黄色潜水艇主场击沉鹦鹉军团,莫里

DeepSeek预测:比利亚雷亚尔vs西班牙人!黄色潜水艇主场击沉鹦鹉军团,莫里

  西甲第23轮即将上演一场欧战资格卡位战,排名第4的比利亚雷亚尔(42分)将在陶瓷球场迎战第6的西班牙人(34分)。主队近期状态起伏不定,近5轮1平4负未尝胜绩;客队则遭遇三连败,但客场...

DeepSeek预测:巴萨主场狂轰法兰克福!拉什福德领衔火力全开,3-1碾压晋级

DeepSeek预测:巴萨主场狂轰法兰克福!拉什福德领衔火力全开,3-1碾压晋级

  欧冠联赛阶段第6轮,巴萨坐镇Spotify诺坎普球场迎战法兰克福。目前巴萨以2胜1平2负积7分排名第18,距离附加赛区仅1分差距;而法兰克福1胜1平3负积4分排名第28,已濒临淘汰边缘...

10月25日DeepSeek预测:太阳vs快船,布克率队延续连胜,快船主场难挡火

10月25日DeepSeek预测:太阳vs快船,布克率队延续连胜,快船主场难挡火

  2025-26赛季NBA常规赛第二比赛日,菲尼克斯太阳将造访加密网竞技场挑战洛杉矶快船。主队快船作为近年西部豪强,新赛季首战21分惨败爵士后排名西部垫底;客队太阳则凭借揭幕战4分险胜国...

“AI才女”罗福莉宣布加入小米,先后任职阿里达摩院、DeepSeek,此前网传雷

“AI才女”罗福莉宣布加入小米,先后任职阿里达摩院、DeepSeek,此前网传雷

  【“AI才女”罗福莉宣布加入小米,先后任职阿里达摩院、DeepSeek,此前网传雷军千万年薪挖角】11月12日,“AI才女”罗福莉在朋友圈官宣加入小米。此前有媒体报道,雷军曾希望用千万...

长文档挑战赛:Qwen2-Plus-Latest 对阵 DeepSeek-V3,

长文档挑战赛:Qwen2-Plus-Latest 对阵 DeepSeek-V3,

  一份10万字行业研究报告,两个当红大模型,一场关于长文档处理能力的终极对决——谁能以更低成本提供更优解决方案?   作为一名金融分析师,我每周都需要处理大量的行业研究...

浪潮信息发布“元脑SD200”超节点,面向万亿参数大模型创新设计

浪潮信息发布“元脑SD200”超节点,面向万亿参数大模型创新设计

  当前,开源模型正取得飞跃式进步,推动研发范式从封闭走向开放协作deepseek。随着大模型参数量的持续提升,对算力基础设施的建设提出了更高要求。8月7日,浪潮信息发布面向万亿参数大模型...