开源大模型得分新纪录!阿里千问3性能全球第三(开源模拟)

开源大模型得分新纪录!阿里千问3性能全球第三(开源模拟)

潮新闻客户端 记者 张云山

8月2日凌晨,国际权威大模型评测 Chatbot Arena更新了最新一期的大模型榜单,上周新鲜开源的阿里千问3新模型斩获1433分,超越顶尖闭源模型Grok4、Claude4,位列所有闭源及开源模型的全球总榜第三。同时,千问3还夺得数学、代码、复杂提示、长文本检索、指令遵循等5项全球第一。

全球知名ChatBot Arena大模型排行榜,千问3位列全球顶级模型第三、开源第一(受访者供图)

Chatbot Arena是由独立研究机构LMSYS Org推出的大模型评测平台,其评测分数被认为是全球最具公信力的大模型榜单。

不到一年前,Qwen2.5-72B是第一个入选该榜前十的中国大模型;上周开源的千问3非思考基础模型 Qwen3-235B-A22B-Instruct-2507 再次实现重大突破,揽获5项关键能力全球第一,并以1433分的总分创下开源大模型的史上最高分,力压Grok4、Claude4、Gemini 2.5-Flash、GPT4.1等一众顶级闭源模型,千问3与GPT4.5并列全球第三。

千问3在数学、代码、复杂提示、长文本、指令遵循等方面位列全球第一(受访者供图)

7月22日起,阿里通义团队接连开源千问3基础模型、AI编程模型和推理模型,性能均实现同类开源模型的新突破。除千问3 指令(Instruct)模型外,推理模型 Qwen3-235B-A22B-Thinking-2507 也闯进榜单前十,数学能力并列全球第一;在Chatbot Arena专门评估编程能力的WebDevArena子榜单中,编程模型Qwen3-Coder性能与Gemini2.5 Pro、DeepSeek-R1、Claude4并列第一。

通义模型(受访者供图)

本周,通义千问仍在以“周级迭代”频率持续更新:Qwen3-30B-A3B 更新了Instruct模型、推理模型、编程模型等3款模型,性能媲美Gemini2.5-flash、GPT-4o,可在消费级硬件直接部署,广受开发者欢迎。

同时,千问3新模型的“训练秘籍”GSPO新算法也对外公开,GSPO从根源上解决了大规模MoE模型在强化学习中的稳定性问题,训练效率较经典GRPO算法实现大幅提升,GSPO论文在全球最大的AI开源社区HuggingFace里论文热度排名第一。

阿里千问模型API调用量市场份额超10.9%,位列全球第四(受访者供图)

阿里AI多连发,在全球范围内引发新一轮接入中国开源模型热潮。

海外大模型API聚合平台OpenRouter数据显示,阿里千问模型全球市场份额逾10.9%,超越OpenAI和Meta-Llama系列模型,位列全球第四;其中,Qwen3-Coder调用量一周暴增1474%,位列编程领域的全球第二。

编程领域中,Qwen3-Coder尤受AI社区欢迎,API调用量一周暴增1474%(受访者供图)

截至目前,阿里已开源300余个模型,持续推进“全尺寸”、“全模态”的全面开源。通义千问衍生模型已超过14万个,是全球第一的开源模型,也是中国企业用得最多的大模型。

未来三年,阿里巴巴还将投入3800亿元在AI和云基础设施建设上,夯实“AI全栈”的技术体系和战略布局,为全球开发者和企业提供更高性能、更普惠的AI和云计算服务。

特别声明:[开源大模型得分新纪录!阿里千问3性能全球第三(开源模拟)] 该文观点仅代表作者本人,今日霍州系信息发布平台,霍州网仅提供信息存储空间服务。

猜你喜欢

TSUTSUI筒井理化学 M-3T 微型电磁振筛机(筒井用水鞴法)

符合 JIS 标准的直径 75mm 的筛框重量轻、结构紧凑、节省空间,任何人都可以轻松筛分少量粉末和颗粒样品。 [技术信息]M-3T使用的弹簧和筛板级数 [技术信息] 预计装入试验筛的样品量<重量> [注…

TSUTSUI筒井理化学 M-3T 微型电磁振筛机(筒井用水鞴法)

青春担当·中国人寿财险浙江青年筑牢双台风防御防线(青春担当使命)

随着台风“范斯高”和第8号台风“竹节草”相继登陆,多地遭遇强风暴雨袭击,在中国人寿财险浙江省分公司党委的号召下,公司共青团立即响应,引领浙江各级机构青年骨干闻“汛”而动,冲锋在前,全面启动防灾减损与保险服务工…

青春担当·中国人寿财险浙江青年筑牢双台风防御防线(青春担当使命)

私生活传闻离谱,刚拿白玉兰视后的宋佳,陪睡上位、赶走原配?(私生活传闻离谱是哪一集)

刚刚出道时,有人建议她更改名字,因为“宋佳”与老一辈的演员名字相似,她则坚定地回应:“我不改”,结果这句话让她被贴上了“情商低”“不懂事”的标签。她的演技无可挑剔,但她不愿讨好别人,也不愿按娱乐圈的规则来包装…

私生活传闻离谱,刚拿白玉兰视后的宋佳,陪睡上位、赶走原配?(私生活传闻离谱是哪一集)

“All in AI”的探索:数字化转型,厦企如何破题?

比气候更炽热的,是厦门企业在数字化转型浪潮中,对人工智能(AI)应用的破釜沉舟与积极探索。7月下旬,记者实地探访厦门国投智能等多家厦门企业,了解科技领域前沿企业和传统企业如何在数字化转型中突破瓶颈、破局向新。…

“All in AI”的探索:数字化转型,厦企如何破题?

救命!这双凉鞋,把春日仙女感焊脚上了,出街不撞款(救命!这双凉鞋好看吗)

最近挖到的这双仙女凉鞋,直接让我把“春日浪漫”穿在了脚上!关键是这独特设计,方头+蝴蝶+细带 ,满大街基础款凉鞋里,它就是“穿搭显眼包”,出街不撞款,轻松穿出“专属仙女感”,发圈被追着问链接的快乐谁懂啊!不管…

救命!这双凉鞋,把春日仙女感焊脚上了,出街不撞款(救命!这双凉鞋好看吗)