
阿里巴巴最近推出了 Qwen 系列的新版本 —— Qwen3.6-Max-Preview。这是一个预览版模型,目前已经可以在 QwenStudio 里直接体验,也支持通过阿里云百炼 API 调用(模型名为 qwen3.6-max-preview)。
相比上一代 Qwen3.6-Plus,这一版本的提升主要集中在编程能力、知识理解以及指令执行这几个方面。
编程能力:提升比较明显
官方给出的数据里,这个模型在多个编程相关的测试中表现都不错,比如:
- SWE-benchPro
- Terminal-Bench 2.0
- SkillsBench
- QwenClawBench
- QwenWebBench
- SciCode
具体提升幅度也比较直观:
- SkillsBench 提高了 9.9 分
- SciCode 提高了 10.8 分
- NL2Repo 提高了 5.0 分
- Terminal-Bench 2.0 提高了 3.8 分
从这些数据来看,它在处理代码生成、复杂任务拆解这类场景上,确实更稳了一些。
知识能力:更全面一点
除了编程,这一版在知识理解上的表现也有所提升:
- SuperGPQA 提高了 2.3 分
- QwenChineseBench 提高了 5.3 分
整体来看,就是在一些需要综合知识、推理或者中文理解的任务里,会更靠谱一点。
指令执行:更听话了
在指令遵循方面也有小幅优化:
- ToolcallFormatIFBench 提升了 2.8 分
这类提升主要体现在格式输出、工具调用这些细节上,虽然不是特别大的变化,但对实际使用体验会有帮助。
目前还是预览版
需要注意的是,这个版本还不是最终形态。阿里方面也提到,Qwen3.6-Max-Preview 还在持续迭代,后面还会继续优化。
简单总结
这一版 Qwen 的升级思路比较清晰:重点强化编程能力,同时把知识理解和指令执行这些基础能力一起补上。虽然还是预览版本,但从目前的数据来看,整体表现已经比上一代更均衡了一些。