阿里云QwQ-32B大模型:萌名之下,能否与『DeepSeek』-R1一较高下?

阿里云QwQ-32B大模型:萌名之下,能否与『DeepSeek』-R1一较高下?

近日,阿里云旗下的『通义千问』团队正式揭晓了其最新的技术成果——QwQ-32B推理模型。这款模型配备了惊人的320亿参数,却在性能上展现出了与拥有6710亿参数(活跃参数370亿)的『DeepSeek』-R1模型相媲美的实力。

QwQ-32B模型现已在Hugging Face和ModelScope两大平台上开源,并遵循Apache 2.0开源协议,这标志着阿里云在推动AI技术开放共享方面迈出了重要一步。

用户可以通过Qwen Chat或通义平台,亲身体验QwQ-32B的强大功能。在Qwen Chat中,用户只需选择Qwen2.5-Plus并开启QwQ深度思考模式,即可感受其卓越的推理能力。同样,在通义App或网页端,用户也能轻松选择Qwen-QwQ-32B智能体进行互动。

尽管QwQ的名字听起来有些俏皮可爱,但其性能却不容小觑。阿里云对QwQ-32B进行了全面的性能测试,包括数学推理、编程能力和通用能力等多个方面。测试结果显示,QwQ-32B在数学能力评测集AIME24和代码能力评估平台LiveCodeBench上的表现,与『DeepSeek』-R1相当,甚至在某些方面超越了后者。同时,在与o1-mini及相同尺寸的R1蒸馏模型的对比中,QwQ-32B也展现出了明显的优势。

在由meta首席科学家杨立昆领衔的“最难LLMs评测榜”LiveBench、谷歌提出的指令遵循能力IFeval评测集以及加州大学伯克利分校等提出的BFCL测试中,QwQ-32B的得分均超过了『DeepSeek』-R1,进一步证明了其强大的推理能力。

阿里云表示,QwQ-32B的推出是其在大规模强化学习(RL)以增强推理能力方面的初步尝试。通过这一尝试,阿里云不仅看到了扩展RL的巨大潜力,还发现了预训练语言模型中尚未充分发掘的可能性。未来,阿里云将继续致力于开发下一代Qwen模型,计划将更强大的基础模型与依托规模化计算资源的RL相结合,以推动人工智能向人工通用智能(AGI)的迈进。

阿里云还在积极探索将智能体与RL集成的可能性,以实现长时推理。这一目标的实现,将有助于通过推理时间的扩展来释放更高的智能水平,为人工智能的发展注入新的活力。

除了QwQ-32B外,阿里云『通义千问』团队还拥有其他强大的模型,如QvQ等,它们共同构成了阿里云在AI领域的强大阵容。

特别声明:[阿里云QwQ-32B大模型:萌名之下,能否与『DeepSeek』-R1一较高下?] 该文观点仅代表作者本人,今日霍州系信息发布平台,霍州网仅提供信息存储空间服务。

猜你喜欢

为了得到歌后玛丽亚凯莉,汤姆布雷迪等人付出了多大的代价?(为了得到爱情的继续是什么歌)

当2008年她与喜剧演员尼克·卡农的龙凤胎诞生时,《美国周刊》调侃道:"这比她的婚姻持久多了——果然,当孩子学会走路时,这对夫妻已因巡演档期冲突分居。 2015年,澳大利亚赌场大亨詹姆斯·帕克用直升机空降35…

为了得到歌后玛丽亚凯莉,汤姆布雷迪等人付出了多大的代价?(为了得到爱情的继续是什么歌)

如何调理舌苔发白(怎么改善舌苔厚)

舌苔白通常是不健康的征兆,常由上火引起。患者常常伴有口臭症状,这给日常生活带来了很大困扰。 饮食应以清淡为主。舌苔厚表明消化功能不佳,此时应减少肉类和脂肪食物的摄入,多吃易消化的食物

如何调理舌苔发白(怎么改善舌苔厚)

王牌9来袭,『沈腾』、贾玲或缺席,『唐嫣』恐难常驻,『华晨宇』引争议(王牌第一季『沈腾』)

他们缺席9的宣传也引发了一些粉丝的猜测和失望。有人猜测可能是因为时间冲突或者其他原因,但也有人担心他们的缺席会影响到影片的质量以及观众对于该片的期待。至于『华晨宇』的加入,尽管存在一些争议,但也有观众表示愿意给他…

王牌9来袭,『沈腾』、贾玲或缺席,『唐嫣』恐难常驻,『华晨宇』引争议(王牌第一季『沈腾』)

胃炎十二指肠球炎出现口臭怎么治(十二指肠球炎是什么意思)

胃炎十二指肠球炎患者常伴有口臭症状,这可能与幽门螺杆菌感染或胃酸分泌异常有关。常见症状包括上腹痛和反酸。治疗该病引起的口臭可以通过调整饮食、保持口腔卫生、药物治疗、中医调理及改善生活习惯等方式进行

胃炎十二指肠球炎出现口臭怎么治(十二指肠球炎是什么意思)

新研究揭示量子霍夫施塔特模型中的奇异相态与斯基尔米翁(量子力学新发现)

该研究的核心在于利用大规模的DMRG模拟,科学家们确认了在特定电子密度下出现的自旋极化分数切尔恩绝缘体(FCI)相,展现出量子特性和有限能量间隙。这一相态的形成不仅表明了相邻电子之间的强相互作用,还揭示了隐…

新研究揭示量子霍夫施塔特模型中的奇异相态与斯基尔米翁(量子力学新发现)