AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

阿里发布Qwen3.6-Max预览版 登顶第三方国产大模型榜单

2026年4月20日,阿里巴巴发布旗下下一代旗舰大模型Qwen3.6-Max-Preview的早期预览版本。该模型在第三方评测机构Artificial Analysis的大模型智能指数榜单中获得52分,得分超过GLM-5.1、MiniMax-M2.7等主流国产模型,登顶该榜单国产模型第一名,这也是通义千问Qwen系列近年来在性能比拼中取得的又一次突破。

---

从2024年开始,全球大模型行业已经进入了“半年一更”的性能迭代周期,头部玩家比拼的不再是“有没有”大模型,而是核心能力谁能再往前推进一步。不同于很多厂商会等到技术细节全部打磨完成才官宣,阿里此次直接放出了下一代旗舰的预览版本,也就是业内所说的“半成品测试版”,并未公开参数量、训练数据规模等核心技术参数,仅对外公布了第三方评测的成绩。

实测发现,即便是未定型的预览版,Qwen3.6-Max-Preview已经具备了相当强的实用能力,他就通过该模型完成了自定义macOS桌面的全流程开发,从需求梳理到代码输出再到功能调试,都不需要人工进行大幅度修改,就能达到可用状态。

Artificial Analysis作为业内认可度较高的第三方独立大模型评测机构,其智能指数排名覆盖了逻辑推理、代码生成、知识问答、多模态理解、指令遵循等五大类核心能力,测试数据不针对特定厂商优化,因此排名结果往往被业内作为衡量大模型真实水平的参考依据。

在此次排名公布前,国产头部大模型的得分普遍集中在50分到51分区间,GLM-5.1和MiniMax-M2.7作为两家厂商最新发布的旗舰模型,此前长期占据国产模型前两位的位置。Qwen3.6-Max-Preview拿到的52分,看似只领先了1-2分,实则是大模型进入高阶阶段后难得的性能突破——当大模型的综合能力已经突破基础门槛,每提升1个评分点,都需要在训练数据筛选、模型结构优化、训练工程调优等多个环节投入大量的研发资源。

此次登顶也打破了此前国产大模型头部阵营的僵持格局,让通义千问系列重新回到国产第一的位置,也印证了阿里在大模型研发上的长期投入开始持续产出成果。

阿里此次选择提前放出预览版成绩,业内普遍认为这是为下半年正式推出Qwen3.6全系列模型预热。作为国内少有的坚持开源+商用双路线发展的大模型系列,Qwen系列的开源版本已经成为全球开发者最常用的国产大模型底座之一,被用于从创业项目到企业级应用的多个场景。

随着Qwen3.6预览版的成绩出炉,国产大模型的下半年竞争已经提前拉响号角。目前来看,头部玩家的性能差距已经缩小到个位数评分,接下来各家都会聚焦于性能落地、成本下降和场景适配,真正把更高性能的大模型能力下放到更多应用中。对于普通用户和开发者来说,头部厂商的良性竞争,最终会带来更好用、更低价的AI服务,加速AI在各行各业的落地进程。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。