超越闭源Grok4、Claude4!全球第三,阿里千问3创下开源模型最高分!

8月2日凌晨,国际权威大模型评测 Chatbot Arena更新了最新一期的大模型榜单,上周新鲜开源的阿里千问3新模型斩获1433分,超越顶尖闭源模型Grok4、Claude4,位列所有闭源及开源模型的全球总榜第三,是全球最强非推理(non-thinking)模型,并创下全球开源模型和国产模型的史上最高分。同时,千问3还夺得数学、代码、复杂提示、长文本检索、指令遵循等5项全球第一。

今日霍州 jrhz.info

今日霍州(www.jrhz.info)©️

全球知名ChatBot Arena大模型排行榜,千问3位列全球顶级模型第三、开源第一

Chatbot Arena是由独立研究机构LMSYS Org推出的大模型评测平台,其评测分数被认为是全球最具公信力的大模型榜单。不到一年前,Qwen2.5-72B是第一个入选该榜前十的中国大模型;上周开源的千问3非思考基础模型 Qwen3-235B-A22B-Instruct-2507 再次实现重大突破,揽获5项关键能力全球第一,并以1433分的总分创下开源大模型的史上最高分,力压Grok4、Claude4、Gemini 2.5-Flash、GPT4.1等一众顶级闭源模型,千问3与GPT4.5并列全球第三。

今日霍州 jrhz.info

今日霍州(www.jrhz.info)©️

千问3在数学、代码、复杂提示、长文本、指令遵循等方面位列全球第一

7月22日起,阿里通义团队接连开源千问3基础模型、AI编程模型和推理模型,性能均实现同类开源模型的新突破。除千问3 指令(Instruct)模型外,推理模型 Qwen3-235B-A22B-Thinking-2507 也闯进榜单前十,数学能力并列全球第一;在Chatbot Arena专门评估编程能力的WebDev Arena子榜单中,编程模型Qwen3-Coder性能与Gemini2.5 Pro、『DeepSeek』-R1、Claude4并列第一。

本周,『通义千问』仍在以“周级迭代”频率持续更新:Qwen3-30B-A3B 更新了Instruct模型、推理模型、编程模型等3款模型,性能媲美Gemini2.5-flash、GPT-4o,可在消费级硬件直接部署,广受开发者欢迎。同时,千问3新模型的“训练秘籍”GSPO新算法也对外公开,GSPO从根源上解决了大规模MoE模型在强化学习中的稳定性问题,训练效率较经典GRPO算法实现大幅提升,GSPO论文在全球最大的AI开源社区HuggingFace里论文热度排名第一。

今日霍州 jrhz.info

今日霍州(www.jrhz.info)©️

阿里千问模型API调用量市场份额超10.9%,位列全球第四

阿里AI多连发,在全球范围内引发新一轮接入中国开源模型热潮。海外大模型API聚合平台OpenRouter数据显示,阿里千问模型全球市场份额逾10.9%,超越OpenAI和Meta-Llama系列模型,位列全球第四;其中,Qwen3-Coder调用量一周暴增1474%,位列编程领域的全球第二。

编程领域中,Qwen3-Coder尤受AI社区欢迎,API调用量一周暴增1474%

截至目前,阿里已开源300余个模型,持续推进“全尺寸”、“全模态”的全面开源。『通义千问』衍生模型已超过14万个,是全球第一的开源模型,也是中国企业用得最多的大模型。未来三年,阿里巴巴还将投入3800亿元在AI和云基础设施建设上,夯实“AI全栈”的技术体系和战略布局,为全球开发者和企业提供更高性能、更普惠的AI和云计算服务。

特别声明:[超越闭源Grok4、Claude4!全球第三,阿里千问3创下开源模型最高分!] 该文观点仅代表作者本人,今日霍州系信息发布平台,霍州网仅提供信息存储空间服务。

猜你喜欢

76岁斯琴高娃生日现场透露,引争议!(斯琴高娃现身体状况)

斯琴高娃不仅在生日这一天收获了祝福,也用她自己的方式,将这份温情回馈给了年轻的同行。 第二段婚姻,她嫁给了演员敖醒晨,原本希望能够开始新的生活,但随着她演艺事业的蒸蒸日上,敖醒晨却因心生不平衡,反对她演绎…

76岁斯琴高娃生日现场透露,引争议!(斯琴高娃现身体状况)

『迪丽热巴』惊艳红毯,优雅动人,尽显魅力!(『迪丽热巴』惊艳时刻)

那束聚光灯下的圣光,是舞台的光辉,是每个角色赋予她的光芒,更是她凭借着非凡的实力与不懈努力,挣得的属于自己的独特星河。她宛如那只永远鲜活的灵猫,随着时光流转,被温柔与实力共同加持,在永恒的馥郁中,她的光芒永不…

『迪丽热巴』惊艳红毯,优雅动人,尽显魅力!(『迪丽热巴』惊艳时刻)

对外卖Copilot,对内用Claude?微软内部正在悄悄换“编程大脑”(对外卖员的赞美句子)

早在 2025年 6 月,微软就已经在其开发者部门内部,引入了 Anthropic 的 Claude Sonnet 4 模型;随后,在GitHub Copilot 的部分付费用户中,也逐渐增加了 Clau…

对外卖Copilot,对内用Claude?微软内部正在悄悄换“编程大脑”(对外卖员的赞美句子)

定喘(定喘定位)

在我们的日常生活中,合理利用穴位能辅助治疗一些疾病。定喘穴,就是一个值得了解的穴位,它位于人体特定位置,通过按摩此穴,可以辅助缓解多种不适。该穴位对于支气管炎、哮喘、百日咳及肩部损伤如肩关节脱位、落枕等问题有良好的缓解作用

定喘(定喘定位)

紫光Q8080Q8095Q6100Q6180Q5260ii扫描仪搓纸轮分纸轮故障如何排查修复?(紫光国微)

紫光Q系列扫描仪搓纸轮分纸轮故障困扰不少用户。本篇文章将详细介绍故障原因,教您排查步骤与修复技巧。无论是卡纸还是扫描质量下降,通过正确的方法都能高效解决,避免不必要的维修成本。 如果你遇到紫光Q8080Q8095Q6100Q6180

紫光Q8080Q8095Q6100Q6180Q5260ii扫描仪搓纸轮分纸轮故障如何排查修复?(紫光国微)