阿里Qwen发布320亿参数QwQ-32B大模型
2025-03-06 13:17:57来源:www.luwei123.com发布:二蛋
3月6日,阿里Qwen团队正式对外发布了其最新的研究成果——QwQ-32B大语言模型。这款模型拥有320亿参数,在性能上能够与参数量高达6710亿的DeepSeek-R1(其中370亿参数被激活)相媲美。
尽管QwQ-32B的参数量仅为DeepSeek-R1的大约1/21,但通过强化学习技术,该模型成功实现了性能上的显著提升。此外,阿里在这款推理模型中还集成了与Agent相关的能力,使其不仅能够使用工具,还能进行批判性思考,并根据环境反馈动态调整推理过程。
QwQ-32B在多项基准测试中接受了全面评估,涉及数学推理、编程能力和通用能力等多个领域。在数学能力测试AIME24评测集中,以及用于评估代码能力的LiveCodeBench测试中,QwQ-32B的表现与DeepSeek-R1相当,并且大幅优于o1-mini和相同规模的R1蒸馏模型。
同时,在由多位知名研究者主导的多个权威评测榜单中,QwQ-32B也取得了优异成绩。例如,在被称为“最难LLMs评测榜”的LiveBench、用于评估指令遵循能力的IFEval评测集,以及针对函数或工具调用准确性测试的BFCL中,QwQ-32B的得分均超过了DeepSeek-R1。
目前,QwQ-32B已经在Hugging Face和ModelScope平台开源,用户还可以通过Qwen Chat直接体验这一先进模型。
上一篇: 苹果新款MacBook数据线售价379元引热议 下一篇: 最后一篇
相关阅读
- 03-06 苹果新款MacBook数据线售价379元引热议
- 03-06 0kex交易平台v6.1.48官方下载 0kex交易平台安卓最新版链接link
- 03-06 中国可重复使用火箭研究取得重要进展
- 03-06 苹果确认M4 Max芯片不具备UltraFusion连接器
- 03-06 瑞波基因币今日行情(瑞波基因币实时行情)
- 03-06 通宇通讯携多项创新成果亮相2025 MWC,助力数字通信全球覆盖
- 03-06 SHURE全新MOVEMIC 88 无线麦克风,为视频带来出色的音频多功能性
- 03-06 赛力斯超级工厂实力支撑 问界汽车持续领跑豪车市场
- 03-06 我国自主研发全球最快400公里时速CR450动车组下线
- 03-06 高校教师鸿蒙应用开发技术师资培训即将开班
- 03-06 0KEX下载-0KEX下载官方app下载-0KEX最新版v6.1.18
- 03-06 苹果新款MacBook Air天蓝色数据线售价379元引热议