阿里发布 Qwen3.6-Max-Preview,新一代模型有哪些变化?

UGC 国内 2026年04月20日 💬 0

阿里巴巴最近推出了 Qwen 系列的新版本 —— Qwen3.6-Max-Preview。这是一个预览版模型,目前已经可以在 QwenStudio 里直接体验,也支持通过阿里云百炼 API 调用(模型名为 qwen3.6-max-preview)。

相比上一代 Qwen3.6-Plus,这一版本的提升主要集中在编程能力、知识理解以及指令执行这几个方面。


编程能力:提升比较明显

官方给出的数据里,这个模型在多个编程相关的测试中表现都不错,比如:

  • SWE-benchPro
  • Terminal-Bench 2.0
  • SkillsBench
  • QwenClawBench
  • QwenWebBench
  • SciCode

具体提升幅度也比较直观:

  • SkillsBench 提高了 9.9 分
  • SciCode 提高了 10.8 分
  • NL2Repo 提高了 5.0 分
  • Terminal-Bench 2.0 提高了 3.8 分

从这些数据来看,它在处理代码生成、复杂任务拆解这类场景上,确实更稳了一些。


知识能力:更全面一点

除了编程,这一版在知识理解上的表现也有所提升:

  • SuperGPQA 提高了 2.3 分
  • QwenChineseBench 提高了 5.3 分

整体来看,就是在一些需要综合知识、推理或者中文理解的任务里,会更靠谱一点。


指令执行:更听话了

在指令遵循方面也有小幅优化:

  • ToolcallFormatIFBench 提升了 2.8 分

这类提升主要体现在格式输出、工具调用这些细节上,虽然不是特别大的变化,但对实际使用体验会有帮助。


目前还是预览版

需要注意的是,这个版本还不是最终形态。阿里方面也提到,Qwen3.6-Max-Preview 还在持续迭代,后面还会继续优化。


简单总结

这一版 Qwen 的升级思路比较清晰:重点强化编程能力,同时把知识理解和指令执行这些基础能力一起补上。虽然还是预览版本,但从目前的数据来看,整体表现已经比上一代更均衡了一些。