阿里发布最新开源推理模型,“性能比肩DeepSeek-R1”
创始人
2025-03-06 17:21:28
0

澎湃新闻记者 胡含嫣

阿里通义发布最新开源推理模型,称其性能比肩DeepSeek-R1。

3月6日凌晨,阿里巴巴正式发布最新的开源推理模型通义千问QwQ-32B。据介绍,通过大规模强化学习,千问QwQ-32B在数学、代码及通用能力上实现质的飞跃,整体性能比肩DeepSeek-R1,同时大幅降低了部署使用成本,在消费级显卡上也能实现本地部署。QwQ-32B采用了Apache 2.0开源协议,目前,所有人都可免费下载及商用QwQ-32B模型,或通过网页版Qwen Chat进行体验,该模型也将免费上架通义APP。

阿里通义团队表示,QwQ-32B模型拥有320亿参数,其性能可与具备6710亿参数(其中370亿被激活)的DeepSeek-R1媲美。在冷启动的基础上,模型针对数学和编程任务、通用能力分别进行了两轮大规模强化学习,在32B的模型尺寸上获得了令人惊喜的推理能力提升,印证了大规模强化学习可显著提高模型性能。

此外,QwQ-32B模型中还集成了与智能体(Agent)相关的能力,使其能够在使用工具的同时进行批判性思考,并根据环境反馈调整推理过程。

千问QwQ-32B既能提供极强的推理能力,又能满足更低的资源消耗需求,这背后的奥秘便在于强化学习(Reinforcement Learning)。阿里通义团队表示:“我们希望,我们的一点努力能够证明强大的基础模型叠加大规模强化学习也许是一条通往通用人工智能(AGI)的可行之路。”

在一系列权威基准测试中,千问QwQ-32B模型都表现出色,几乎完全超越了OpenAI去年9月发布的尺寸相近的o1-mini模型,比肩最强开源推理模型DeepSeek-R1:在测试数学能力的AIME24评测集上,以及评估代码能力的LiveCodeBench中,千问QwQ-32B表现与DeepSeek-R1相当,远胜于o1-mini及相同尺寸的R1蒸馏模型。

QwQ-32B模型和R1、OpenAI-o1-mini等知名模型的评分比较。来源:阿里通义

阿里通义团队表示,未来将继续探索将智能体与强化学习的集成,以实现长时推理,探索更高智能进而最终实现AGI的目标。

3月6日早盘,阿里巴巴集团(09988.HK)港股大幅高开涨超6%,截至午盘涨超7%。

此前,2月25日,阿里通义Qwen发布基于旗舰模型Qwen2.5-Max构建的推理模型QwQ-Max-Preview预览版,支持联网搜索,会和DeepSeek以及Kimi的推理模型一样展现思考过程,目前用户可在通义千问网页版进行体验。

本期编辑 邢潭

相关内容

热门资讯

桨板运动成夏日新宠 6月15日傍晚,在武汉南岸嘴波光粼粼的江面上,桨板爱好者们脚踩桨板,手拿划桨,在水面上划出一道道优美...
泡泡玛特:这里暂停线下销售 近日,LABUBU火遍全球,韩国泡泡玛特线下门店近乎疯狂,有人为它通宵排队,还出现了吵架动手等情况。...
“我们是互相挂念的老朋友”——...   这是6月3日在哈萨克斯坦伊塞克国家历史文化博物馆附近拍摄的中哈联合考古现场。新华社记者李任滋摄 ...
通讯丨“正在计划下一次赴中国旅...   “马来西亚的朋友们太热情了!他们排着队,点名要‘白娘子’‘哪吒’‘十二生肖’!”来自中国辽宁省沈...
经济随笔丨破解“急难愁盼”要把...   “解决群众急难愁盼”,写进了中央文件的标题。  中办、国办日前印发《关于进一步保障和改善民生 着...
Labubu新品遭黄牛哄抢高价... 6月12日晚上10点,泡泡玛特在线上小程序和官方旗舰店发布系列新品,其中,Labubu新品THE M...
【文化和自然遗产日】漫动时节丨...   一茶一盏  品味人间清欢  茶,一片神奇的东方树叶  从“柴米油盐酱醋茶”  到“琴棋书画诗酒茶...
沙特起网将启用自营模式?京东物... 每经记者|王郁彪 每经实习编辑|余婷婷 京东沙特起网或迎来关键进展。 6月15日,京东物流海外某社...
印度承诺:3月内公布空难调查报... 央视新闻 当地时间12日,印度古吉拉特邦艾哈迈达巴德机场附近发生的坠机事故。目前坠机事故遇难人数已升...
下周我国高温再度发展局地或达4...   今天(6月15日),我国四川、新疆、河南等地部分地区出现高温天气。下周初,上述地区高温持续,同时...
“定制”车管服务让131台车转... 荆楚网(湖北日报网)讯(通讯员 孙燕、梁政)“原以为办理这么多车转让登记是场3到5天的持久战,没想到...
伊朗国防部总部遭以色列袭击   伊朗塔斯尼姆通讯社15日报道说,位于首都德黑兰的伊朗国防部总部遭以色列袭击,一栋办公楼受损。以色...
广西玉林突发泥石流致3人遇难   中新网玉林6月15日电 6月14日晚,受今年1号台风“蝴蝶”影响,持续强降雨导致广西玉林市陆川县...
走私肉毒素流入市场,“轻医美原... 尽管“轻医美”已很常见,但并不等于没有风险,更不等于可以忽视医美产品的质量问题。 ▲部分走私的医美...
杨幂在《酱园弄》开拍前才知道要... 极目新闻记者戎钰发自上海6月14日晚,本届上海国际电影节开幕影片《酱园弄·悬案》在沪首映,章子怡等几...
直击海军某潜艇支队作战应用训练 近日,海军某潜艇支队组织潜艇奔赴任务海域开展作战应用训练。 (央广网·军事频道 作者:时...
在伊华人亲述遭空袭后的伊朗: ... 极目新闻记者 李曼英6月13日凌晨以来,以色列持续大规模空袭伊朗,轰炸核设施和军事目标,造成大量人员...
香港即将就数字资产发展发表第二...   新华社香港6月15日电(记者 孟佳)香港特区政府财政司司长陈茂波15日发表网志表示,香港股市及资...
国际原子能机构:伊核设施多次遭... 据央视新闻消息,国际原子能机构当地时间14日表示,据伊朗核监管部门通报,尽管伊朗伊斯法罕核设施在以色...
焦点访谈丨从“活起来”到“火起...   央视网消息(焦点访谈):6月14日是今年的文化和自然遗产日。我国拥有丰富的文化和自然遗产,其中,...