| 阿里Qwen团队正式发布他们最新的研究成果 —— QwQ-32B大语言模型。这是一款拥有320亿参数的模型,其性能可与具备6710亿参数(其中370亿被激活)的DeepSeek-R1媲美。 官方给出基准评测结果,涵盖了数学推理、代码能力和通用问题解决等多个方面。从数据中我们可以清晰地看到,在 AIME24 和 IFEval 等关键基准测试中,QwQ-32B 的表现甚至略微超过了参数量巨大的 DeepSeek-R1。而在其他基准测试中,也基本与 DeepSeek-R1 持平,远超其他对比模型。 .华.尔.街.见.闻 |