您的位置: 首页 > 实时讯息 >

阿里发布最新开源推理模型,“性能比肩DeepSeek-R1”

0次浏览     发布时间:2025-03-07 00:20:00    

澎湃新闻记者 胡含嫣

阿里通义发布最新开源推理模型,称其性能比肩DeepSeek-R1。

3月6日凌晨,阿里巴巴正式发布最新的开源推理模型通义千问QwQ-32B。据介绍,通过大规模强化学习,千问QwQ-32B在数学、代码及通用能力上实现质的飞跃,整体性能比肩DeepSeek-R1,同时大幅降低了部署使用成本,在消费级显卡上也能实现本地部署。QwQ-32B采用了Apache 2.0开源协议,目前,所有人都可免费下载及商用QwQ-32B模型,或通过网页版Qwen Chat进行体验,该模型也将免费上架通义APP。

阿里通义团队表示,QwQ-32B模型拥有320亿参数,其性能可与具备6710亿参数(其中370亿被激活)的DeepSeek-R1媲美。在冷启动的基础上,模型针对数学和编程任务、通用能力分别进行了两轮大规模强化学习,在32B的模型尺寸上获得了令人惊喜的推理能力提升,印证了大规模强化学习可显著提高模型性能。

此外,QwQ-32B模型中还集成了与智能体(Agent)相关的能力,使其能够在使用工具的同时进行批判性思考,并根据环境反馈调整推理过程。

千问QwQ-32B既能提供极强的推理能力,又能满足更低的资源消耗需求,这背后的奥秘便在于强化学习(Reinforcement Learning)。阿里通义团队表示:“我们希望,我们的一点努力能够证明强大的基础模型叠加大规模强化学习也许是一条通往通用人工智能(AGI)的可行之路。”

在一系列权威基准测试中,千问QwQ-32B模型都表现出色,几乎完全超越了OpenAI去年9月发布的尺寸相近的o1-mini模型,比肩最强开源推理模型DeepSeek-R1:在测试数学能力的AIME24评测集上,以及评估代码能力的LiveCodeBench中,千问QwQ-32B表现与DeepSeek-R1相当,远胜于o1-mini及相同尺寸的R1蒸馏模型。

QwQ-32B模型和R1、OpenAI-o1-mini等知名模型的评分比较。来源:阿里通义

阿里通义团队表示,未来将继续探索将智能体与强化学习的集成,以实现长时推理,探索更高智能进而最终实现AGI的目标。

3月6日早盘,阿里巴巴集团(09988.HK)港股大幅高开涨超6%,截至午盘涨超7%。

此前,2月25日,阿里通义Qwen发布基于旗舰模型Qwen2.5-Max构建的推理模型QwQ-Max-Preview预览版,支持联网搜索,会和DeepSeek以及Kimi的推理模型一样展现思考过程,目前用户可在通义千问网页版进行体验。



本期编辑 邢潭


图片

相关文章

量子传感新技术“攻克”退相干难题

【量子传感新技术“攻克”退相干难题】财联社4月30日电,据《自然·通讯》杂志29日报道,美国南加州大学的研究人员展示了一种新型量子传感技术,可借助新的相干稳定协议对抗量子退相干。其性能大幅超越传统方法,有望推动从医学成像到基础物理研究等多个领域的进步。量子传感是指利用量子系统(如原子、光子或量子比特
2025-04-30 06:18:00

起步早、生态好、政策足!模速空间“C位出道”的阶跃星辰点赞“模都”

4月29日上午,习近平总书记在上海考察时,来到位于徐汇区的上海“模速空间”大模型创新生态社区调研。记者获悉,在“模速空间”展馆中,上海大模型独角兽企业阶跃星辰演示了旗下基础大模型的技术发展和应用情况。“国家高度重视人工智能的发展,其中基础大模型起到重要作用,是一场需要定力和实力的‘科技长征’。”阶跃
2025-04-29 23:26:00

一克商评|从“经验驱动”到“数据驱动”,四川场道以科技为翼实现“智能建造”

封面新闻记者 张越熙 易弋力科技创新+管理优化,四川场道打造精品工程4月25日,记者从四川省场道工程有限公司获悉,在数字化浪潮奔涌的当下,广安市政工程以科技为翼,通过无人机、智能安全帽、高边坡智能检测、物料验收系统、安全视频监控,实现数字底盘与实体工程的同步映射。面对山地仿古建筑复杂结构,团队创新应
2025-04-25 20:10:00

成都高新区产业基金规模超3200亿!

今日,2025年成都高新区产业基金协同发展大会在成都高新区菁蓉汇举办。会上,成都高新区正式发布产业发展图谱,建立“3+6+6”现代化产业体系,并宣布打造目标规模20亿元的“中试基金”和50亿元“数字文创母基金”,力争通过“中试+基金”模式,助力科研成果从实验室研发向规模量产快速转化。推出3000亿规
2025-04-25 18:07:00

精准护航花季少女!贵阳妇幼保健院团队破解生命 “隐秘通道” 难题

近日,贵阳市妇幼保健院小儿青少年妇科团队(普通妇科一病区)成功为三名生殖道畸形小姑娘实施矫正手术,三例手术均取得圆满成功,三位花季少女术后恢复良好,标志着该科室团队在女性生殖系统畸形诊疗领域的技术实力迈上新台阶,为女性生殖道畸形疾病的规范化治疗提供范本。 突破技术难点,精准护航生育力生殖道畸形是女性
2025-04-25 12:14:00

卫星太多,AI帮忙管!我国首款航天私域大模型迭代升级

昨天,在2025年“中国航天日”活动中,我国首款航天私域大模型“华山”的升级迭代产品——软硬一体化大模型“华山大模型一体化系统”正式亮相。它有望打破以往大模型应用对服务器及配置环境要求高、投入成本高的问题,并大幅降低人工智能应用于航天场景的成本。卫星数量爆发,AI帮忙管理随着卫星互联网、千帆星座等计
2025-04-25 10:04:00

网站内容来自网络,如有侵权请联系我们,立即删除!
站长邮箱 admin@99-bm.com Copyright © 99便民 鲁ICP备19046937号-5