阿里云QwQ-32B大模型:萌名之下,能否与DeepSeek-R1一较高下?

阿里云QwQ-32B大模型:萌名之下,能否与DeepSeek-R1一较高下?

近日,阿里云旗下的通义千问团队正式揭晓了其最新的技术成果——QwQ-32B推理模型。这款模型配备了惊人的320亿参数,却在性能上展现出了与拥有6710亿参数(活跃参数370亿)的DeepSeek-R1模型相媲美的实力。

QwQ-32B模型现已在Hugging Face和ModelScope两大平台上开源,并遵循Apache 2.0开源协议,这标志着阿里云在推动AI技术开放共享方面迈出了重要一步。

用户可以通过Qwen Chat或通义平台,亲身体验QwQ-32B的强大功能。在Qwen Chat中,用户只需选择Qwen2.5-Plus并开启QwQ深度思考模式,即可感受其卓越的推理能力。同样,在通义App或网页端,用户也能轻松选择Qwen-QwQ-32B智能体进行互动。

尽管QwQ的名字听起来有些俏皮可爱,但其性能却不容小觑。阿里云对QwQ-32B进行了全面的性能测试,包括数学推理、编程能力和通用能力等多个方面。测试结果显示,QwQ-32B在数学能力评测集AIME24和代码能力评估平台LiveCodeBench上的表现,与DeepSeek-R1相当,甚至在某些方面超越了后者。同时,在与o1-mini及相同尺寸的R1蒸馏模型的对比中,QwQ-32B也展现出了明显的优势。

在由meta首席科学家杨立昆领衔的“最难LLMs评测榜”LiveBench、谷歌提出的指令遵循能力IFeval评测集以及加州大学伯克利分校等提出的BFCL测试中,QwQ-32B的得分均超过了DeepSeek-R1,进一步证明了其强大的推理能力。

阿里云表示,QwQ-32B的推出是其在大规模强化学习(RL)以增强推理能力方面的初步尝试。通过这一尝试,阿里云不仅看到了扩展RL的巨大潜力,还发现了预训练语言模型中尚未充分发掘的可能性。未来,阿里云将继续致力于开发下一代Qwen模型,计划将更强大的基础模型与依托规模化计算资源的RL相结合,以推动人工智能向人工通用智能(AGI)的迈进。

阿里云还在积极探索将智能体与RL集成的可能性,以实现长时推理。这一目标的实现,将有助于通过推理时间的扩展来释放更高的智能水平,为人工智能的发展注入新的活力。

除了QwQ-32B外,阿里云通义千问团队还拥有其他强大的模型,如QvQ等,它们共同构成了阿里云在AI领域的强大阵容。

特别声明:[阿里云QwQ-32B大模型:萌名之下,能否与DeepSeek-R1一较高下?] 该文观点仅代表作者本人,今日霍州系信息发布平台,霍州网仅提供信息存储空间服务。

猜你喜欢

关税加至35%,加拿大为何遭美国下狠手?芬太尼问题成导火索(关税涨价到25%是真的吗)

当地时间7月31日晚,美国总统特朗普宣布自8月1日起将加拿大输美商品关税税率从25%上调至35%,远高于美国对英国的10%和对欧盟、日韩的15%税率

关税加至35%,加拿大为何遭美国下狠手?芬太尼问题成导火索(关税涨价到25%是真的吗)

并网不慌,离网不愁!并离网逆变器,一站式解决你的电力需求(并网离网区别)

中邦电气的储能逆变器采用智能切换技术,可在0.02秒内完成并网与离网模式的无缝转换。 在离网模式下模拟传统电网的电压和频率特性,可同时驱动空调、水泵等感性负载,系统过载能力达150%,完美解决离网系统带载能力…

并网不慌,离网不愁!并离网逆变器,一站式解决你的电力需求(并网离网区别)

企业数字化营销需要AI驱动,烟台创想企服数字赋能数字化营销(企业数字化营销渠道)

创想企服通过AI搜索优化技术,构建了一套涵盖用户画像分析、语义理解、内容生成和主动营销的完整解决方案,助力企业在智能流量时代抢占先机。传统营销往往依赖静态标签,难以捕捉用户动态需求,而创想企服的AI系统整合企…

企业数字化营销需要AI驱动,烟台创想企服数字赋能数字化营销(企业数字化营销渠道)

杭州上城加快建设中央创新区(杭州上城区未来规划建设)

上城要建设中央创新区,核心在于把握人工智能这一关键变量,构建“1+5”推进格局:即以具身智能先导区为重点,全面建设钱塘江金融港湾核心区、数智时尚消费第一区、大宗商品投资贸易服务创新中心核心区、人文经济创新引…

杭州上城加快建设中央创新区(杭州上城区未来规划建设)

tokyokeiso东京计装RD-1000 中继装置(东京科技)

家>流量计液位计产品指南>液位开关>RD-1000在这种情况下,可以使用RD-1000继电器驱动器将簧片开关触点的运动改变为大容量的C触点,从而允许其控制需要大容量的电路。RD-1000继电器驱动

tokyokeiso东京计装RD-1000 中继装置(东京科技)