阿里通义发布320亿参数QwQ-32B大模型性能比肩国际领先水平
创始人
2025-03-06 14:22:02

2025-03-06 07:40:50 作者:

3月6日消息,阿里巴巴通义千问团队正式发布了其最新研究成果——QwQ-32B大语言模型。该模型拥有320亿参数规模,尽管参数量远小于某些大型模型,但其性能却能够与参数量高达6710亿(其中370亿参数被激活)的国际领先模型DeepSeek-R1相媲美。

通过强化学习技术,QwQ-32B在参数量仅为DeepSeek-R1约1/21的情况下,实现了性能上的显著提升。此外,阿里巴巴还为这一推理模型集成了与Agent相关的能力,使其不仅能够在使用工具时进行批判性思考,还能根据外部环境反馈动态调整推理过程。

QwQ-32B在多项基准测试中展现了卓越的表现,涵盖数学推理、编程能力及通用能力等多个领域。在评估数学能力的AIME24评测集以及测试代码生成能力的LiveCodeBench评测中,QwQ-32B的表现与DeepSeek-R1相当,并且大幅优于o1-mini及参数规模相同的R1蒸馏模型。

不仅如此,在多个权威评测榜单上,QwQ-32B同样取得了优异成绩。例如,在由meta首席科学家领衔开发的“最具挑战性LLMs评测榜”LiveBench、谷歌提出的指令遵循能力评估体系IFeval,以及加州大学伯克利分校设计的函数或工具调用准确性评估测试BFCL中,QwQ-32B的得分均超越了DeepSeek-R1。

目前,QwQ-32B已经在国际知名开源平台以及阿里巴巴旗下的ModelScope上对外开源,用户也可以通过Qwen Chat直接体验这一模型的功能。

⚠️
本网站信息内容及素材来源于网络采集或用户发布,如涉及侵权,请及时联系我们,发送链接至2697952338@QQ.COM,我们将第一时间进行核实与删除处理。

相关内容

热门资讯

新一批“科技副总”上岗!聚焦电... 5月14日,“科创天府·智汇蓉城”成都市“科技副总”选聘(电子信息与人工智能领域)专场活动举行。在蓉...
10大护肝排毒食物!轮流换着吃... 肝脏是人体重要的代谢与解毒器官,承担着分解毒素、合成营养、调节免疫等多重任务。一旦肝火偏旺或功能下降...
原创 A... A股“股王”出事了。 就在刚刚,源杰科技甩出一份公告,字少,事大—— 公司副总经理陈文君,因涉嫌刑事...
美股异动丨思科盘前大涨超19%... 全球最大网络设备制造商思科(CSCO.US)盘前大涨超19%,报121.47美元,开盘势将再创历史新...
今日金价拐点显现,下周行情或将... 5月14日的黄金市场走出了明显的拐点形态,多空双方力量在此消彼长中达到了短暂的平衡,这种蓄势待发的状...
收盘丨沪指跌1.52%,猪肉、... 5月14日,四大股指集体收跌,沪指跌1.52%,深证成指跌2.14%,创业板指跌2.16%,科创综指...
世纪互联盘中狂飙逾30%!宁德... 5月13日,世纪互联(VNET.US)宣布引入新的战略投资者,PJ Millennium I Lim...
国有大行首个要关停的信用卡AP... 来源:图虫 5月13日,中国银行信用卡公众号发布信息称,为进一步整合服务资源,优化线上金融服务体验,...
微纳星空IPO的几点探讨:低比... 来源:市场资讯 来源:基本面解码 北京微纳星空科技股份有限公司(以下简称“微纳星空”)微纳星空是国内...
路演互动丨龙辰科技5月15日北... 来源:全景财经 并在北交所上市网上路演 股票代码:920161 本活动于2026年5月15日(星期五...