中文科技资讯
业界资讯 互联网 手机资讯 电脑硬件 数码产品 家电产品 APP应用 手机游戏 美通快讯

阿里云QwQ-32B大模型:萌名之下,能否与DeepSeek-R1一较高下?

2025-03-06来源:ITBEAR编辑:瑞雪

近日,阿里云旗下的通义千问团队正式揭晓了其最新的技术成果——QwQ-32B推理模型。这款模型配备了惊人的320亿参数,却在性能上展现出了与拥有6710亿参数(活跃参数370亿)的DeepSeek-R1模型相媲美的实力。

QwQ-32B模型现已在Hugging Face和ModelScope两大平台上开源,并遵循Apache 2.0开源协议,这标志着阿里云在推动AI技术开放共享方面迈出了重要一步。

用户可以通过Qwen Chat或通义平台,亲身体验QwQ-32B的强大功能。在Qwen Chat中,用户只需选择Qwen2.5-Plus并开启QwQ深度思考模式,即可感受其卓越的推理能力。同样,在通义App或网页端,用户也能轻松选择Qwen-QwQ-32B智能体进行互动。

尽管QwQ的名字听起来有些俏皮可爱,但其性能却不容小觑。阿里云对QwQ-32B进行了全面的性能测试,包括数学推理、编程能力和通用能力等多个方面。测试结果显示,QwQ-32B在数学能力评测集AIME24和代码能力评估平台LiveCodeBench上的表现,与DeepSeek-R1相当,甚至在某些方面超越了后者。同时,在与o1-mini及相同尺寸的R1蒸馏模型的对比中,QwQ-32B也展现出了明显的优势。

在由meta首席科学家杨立昆领衔的“最难LLMs评测榜”LiveBench、谷歌提出的指令遵循能力IFeval评测集以及加州大学伯克利分校等提出的BFCL测试中,QwQ-32B的得分均超过了DeepSeek-R1,进一步证明了其强大的推理能力。

阿里云表示,QwQ-32B的推出是其在大规模强化学习(RL)以增强推理能力方面的初步尝试。通过这一尝试,阿里云不仅看到了扩展RL的巨大潜力,还发现了预训练语言模型中尚未充分发掘的可能性。未来,阿里云将继续致力于开发下一代Qwen模型,计划将更强大的基础模型与依托规模化计算资源的RL相结合,以推动人工智能向人工通用智能(AGI)的迈进。

阿里云还在积极探索将智能体与RL集成的可能性,以实现长时推理。这一目标的实现,将有助于通过推理时间的扩展来释放更高的智能水平,为人工智能的发展注入新的活力。

除了QwQ-32B外,阿里云通义千问团队还拥有其他强大的模型,如QvQ等,它们共同构成了阿里云在AI领域的强大阵容。

华为Mate 80系列登场:麒麟芯片领航,性能影像通信全方位升级
华为表示,新一代手机支持 3DGS 渲染加速,对比 Mate 70 系列提升了 33%,同时支持光线追踪硬加速,每秒可光线渲染 2000万条。 影像方面,这一代的 Mate 全系搭载了第二代红枫影像技术,…

2025-11-26

星闪技术引领变革,华为新品开启无线音频“真无损”全新时代
在 AI 降噪方面,海思谛听方案集成了基于 AI 的智能降噪技术,通过端侧 AI算力,实现精准降噪,这一技术还可以和星闪传输形成“分工协同”:AI 降噪负责“净化”音频源,星闪负责“无损传输”净化后的信号…

2025-11-26

成研院AI巡考方案斩获双奖 助力2025高考公平与产业数智升级
中国移动(成都)产业研究院(以下简称“成研院”)参与申报的“云智算加持AI巡考—为2025高考公平‘站岗’”创新解决方案,一举斩获大赛“移动赛道”特等奖,同时获评“API调用最佳案例奖”,充分彰显成研院在人工…

2025-11-26

荣耀500系列新机来袭!8000mAh大电池+超强影像,2699元起香不香?
你们觉得这次荣耀500 系列的外观怎么样? 相比友商的 2 亿像素 1/1.56'' HP5 ,荣耀拥有更大的底! 在荣耀 GT系列同款「幻影引擎」的优化加持下,性能表现应该还是可以的。 你们觉得荣耀这次…

2025-11-26

6.3英寸小屏+7000mAh长续航+电竞芯,iQOO新机或成小屏性能新标杆
小屏手机要是为了精致和质感,牺牲了性能就不太好了,事实证明小屏手机的性能还是很重要的,之前魅族22发布的时候,给到骁龙8s Gen4处理器被大众吐槽,虽然热度高却卖的一般般。 而近期oppo发布的reno …

2025-11-26