开源大模型得分新纪录!阿里千问3性能全球第三(开源模拟)

开源大模型得分新纪录!阿里千问3性能全球第三(开源模拟)

潮新闻客户端 记者 张云山

8月2日凌晨,国际权威大模型评测 Chatbot Arena更新了最新一期的大模型榜单,上周新鲜开源的阿里千问3新模型斩获1433分,超越顶尖闭源模型Grok4、Claude4,位列所有闭源及开源模型的全球总榜第三。同时,千问3还夺得数学、代码、复杂提示、长文本检索、指令遵循等5项全球第一。

全球知名ChatBot Arena大模型排行榜,千问3位列全球顶级模型第三、开源第一(受访者供图)

Chatbot Arena是由独立研究机构LMSYS Org推出的大模型评测平台,其评测分数被认为是全球最具公信力的大模型榜单。

不到一年前,Qwen2.5-72B是第一个入选该榜前十的中国大模型;上周开源的千问3非思考基础模型 Qwen3-235B-A22B-Instruct-2507 再次实现重大突破,揽获5项关键能力全球第一,并以1433分的总分创下开源大模型的史上最高分,力压Grok4、Claude4、Gemini 2.5-Flash、GPT4.1等一众顶级闭源模型,千问3与GPT4.5并列全球第三。

千问3在数学、代码、复杂提示、长文本、指令遵循等方面位列全球第一(受访者供图)

7月22日起,阿里通义团队接连开源千问3基础模型、AI编程模型和推理模型,性能均实现同类开源模型的新突破。除千问3 指令(Instruct)模型外,推理模型 Qwen3-235B-A22B-Thinking-2507 也闯进榜单前十,数学能力并列全球第一;在Chatbot Arena专门评估编程能力的WebDevArena子榜单中,编程模型Qwen3-Coder性能与Gemini2.5 Pro、『DeepSeek』-R1、Claude4并列第一。

通义模型(受访者供图)

本周,『通义千问』仍在以“周级迭代”频率持续更新:Qwen3-30B-A3B 更新了Instruct模型、推理模型、编程模型等3款模型,性能媲美Gemini2.5-flash、GPT-4o,可在消费级硬件直接部署,广受开发者欢迎。

同时,千问3新模型的“训练秘籍”GSPO新算法也对外公开,GSPO从根源上解决了大规模MoE模型在强化学习中的稳定性问题,训练效率较经典GRPO算法实现大幅提升,GSPO论文在全球最大的AI开源社区HuggingFace里论文热度排名第一。

阿里千问模型API调用量市场份额超10.9%,位列全球第四(受访者供图)

阿里AI多连发,在全球范围内引发新一轮接入中国开源模型热潮。

海外大模型API聚合平台OpenRouter数据显示,阿里千问模型全球市场份额逾10.9%,超越OpenAI和Meta-Llama系列模型,位列全球第四;其中,Qwen3-Coder调用量一周暴增1474%,位列编程领域的全球第二。

编程领域中,Qwen3-Coder尤受AI社区欢迎,API调用量一周暴增1474%(受访者供图)

截至目前,阿里已开源300余个模型,持续推进“全尺寸”、“全模态”的全面开源。『通义千问』衍生模型已超过14万个,是全球第一的开源模型,也是中国企业用得最多的大模型。

未来三年,阿里巴巴还将投入3800亿元在AI和云基础设施建设上,夯实“AI全栈”的技术体系和战略布局,为全球开发者和企业提供更高性能、更普惠的AI和云计算服务。

特别声明:[开源大模型得分新纪录!阿里千问3性能全球第三(开源模拟)] 该文观点仅代表作者本人,今日霍州系信息发布平台,霍州网仅提供信息存储空间服务。

猜你喜欢

环宇证券|高频交易股市中的‘猎豹’,如何捕捉股票涨幅(环宇股指是正规平台吗)

这些算法模型如同猎豹的感官系统,7x24小时不间断地扫描全市场,从海量的订单流中识别出那些可能预示短期价格变动的模式——也许是两个关联资产间短暂的定价偏离,也许是一个大型订单即将进入市场引发的“涟漪效应”。他…

环宇证券|高频交易股市中的‘猎豹’,如何捕捉股票涨幅(环宇股指是正规平台吗)

有哪些美女让你过目难忘?(那些美女)

· 难忘之处: 她是“民国世界的临水照花人”,以她那份早慧的清醒与孤傲,创造出一种与众不同的美。 · 难忘之处:她拥有丰腴与神性的美,是最原始、最蓬勃,也最具争议的女性♀️魅力代表。 · 难忘之处: 她是优雅…

有哪些美女让你过目难忘?(那些美女)

59岁刘嘉玲52岁颜丙燕同框,一个性感一个脸肿,皮相骨相区别明显(刘嘉玲28年前)

红毯后,她与年轻小生『于适』合影,照片中完全看不出两人有30岁差距,刘嘉玲的颜值与身材堪称减龄典范。颜丙燕的颜值曾是许多人心中的女神,但随着岁月的流逝,她的容貌和身材都发生了显著变化。尽管颜丙燕比刘嘉玲年轻7岁,…

59岁刘嘉玲52岁颜丙燕同框,一个性感一个脸肿,皮相骨相区别明显(刘嘉玲28年前)

李亚鹏官宣离婚11天,海哈金喜满脸堆笑,在公园游玩没有一点伤感(李亚鹏官宣离婚的英文歌叫什么)

在整个搬家过程中,李亚鹏并未现身,镜头前只看到了海哈金喜与她3岁的女儿,单独处理这件大事。有些人认为,她或许是在利用李亚鹏的名气,借助这段婚姻提升了自己的知名度和身价;而另一些人则认为,离婚只是为了保护家庭,…

李亚鹏官宣离婚11天,海哈金喜满脸堆笑,在公园游玩没有一点伤感(李亚鹏官宣离婚的英文歌叫什么)

探索现代击剑的巅峰装备:UNIC尤尼科与FOLO佛罗重剑马钢剑条(现代击剑运动分为四个键)

在现代击剑领域,UNIC尤尼科和FOLO佛罗推出的重剑马钢剑条已成为专业选手和训练者的首选装备。它们不仅通过FIE国际剑联认证,更以其精湛工艺和高性能表现,在世界范围内广受赞誉。本文将深入解析其设计原理、应用价值及发展前景。

探索现代击剑的巅峰装备:UNIC尤尼科与FOLO佛罗重剑马钢剑条(现代击剑运动分为四个键)