本文由第三方AI基于17173文章http://news.17173.com/content/03062025/205127908.shtml提炼总结而成,可能与原文真实意图存在偏差。不代表网站观点和立场。推荐点击链接阅读原文细致比对和校验。
阿里推出全新推理模型:仅1/21参数媲美DeepSeek R1
2025-03-06 20:51:28
神评论
阿里Qwen团队正式发布他们最新的研究成果——QwQ-32B大语言模型。
这是一款拥有320亿参数的模型,其性能可与具备6710亿参数(其中370亿被激活)的DeepSeek-R1媲美。
QwQ-32B在仅有DeepSeek-R1约1/21参数量的情况下,用强化学习实现了性能上的跨越。
此外,阿里还在推理模型中集成了与Agent相关的能力,使其能够在使用工具的同时进行批判性思考,并根据环境反馈调整推理过程。
QwQ-32B 在一系列基准测试中进行了评估,测试了数学推理、编程能力和通用能力。
其中,在测试数学能力的AIME24评测集上,以及评估代码能力的LiveCodeBench中,千问QwQ-32B表现与DeepSeek-R1相当,远胜于o1-mini及相同尺寸的R1 蒸馏模型。
同时,在由Meta首席科学家杨立昆领衔的“最难LLMs评测榜”LiveBench、谷歌等提出的指令遵循能力IFEval评测集、由加州大学伯克利分校等提出的评估准确调用函数或工具方面的BFCL测试中,千问QwQ-32B的得分均超越了DeepSeek- R1。
目前,QwQ-32B已在Hugging Face和ModelScope开源,大家也可通过Qwen Chat直接进行体验!
【来源:快科技】
关于阿里,推理模型的新闻
- (2025-12-16) 阿里发布电影级视频模型万相2.6 首次支持角色扮演功能
- (2025-12-11) 朱啸虎:腾讯过去20年从不烧钱试错
- (2025-12-11) 朱啸虎:腾讯过去20年从不烧钱试错 一直是等大家打明白了才发力
- (2025-12-09) 《自然》2025年度十大科学人物发布:DeepSeek创始人梁文锋入选
- (2025-12-01) 京东、美团、阿里外卖大战:半年烧了800亿!你薅了多少羊毛?




