阿里推出全新推理模型,仅1/20参数媲美DeepSeek R1

LR阅读:2025-03-06 07:39:40

3月6日,阿里Qwen团队正式发布他们**的研究成果 —— QwQ-32B大语言模型!QwQ-32B在**DeepSeek-R1约1/20参数量的情况下, 用强化学习,实现了性能上的惊人跨越!

官方给出基准评测结果,涵盖了数学推理、代码能力和通用问题解决等多个方面。从数据中我们可以清晰地看到,在 AIME24 和 IFEval 等关键基准测试中,QwQ-32B 的表现甚至略微超过了参数量巨大的 DeepSeek-R1! 而在其他基准测试中,也基本与 DeepSeek-R1 持平,远超其他对比模型。

本文 巴适财经 原创,转载保留链接!网址:/article/840554.html

标签:快讯
声明

1.本站遵循行业规范,任何转载的稿件都会明确标注作者和来源;2.本站的原创文章,请转载时务必注明文章作者和来源,不尊重原创的行为我们将追究责任;3.作者投稿可能会经我们编辑修改或补充。

关注我们

扫一扫关注我们,了解最新精彩内容

搜索