云溪大会Qwen4 一次放出四张牌:Max、Flash、Plus,还有个 27B 留给你本地跑

📡 AI新闻 2026-09-25 约 11 分钟阅读

云溪大会Qwen4 一次放出四张牌:Max、Flash、Plus,还有个 27B 留给你本地跑 今天上午,2026 云栖大会在杭州开场。阿里 CEO 吴泳铭上台讲了机器智能时代,随后通义千问负责人刘大一恒第一次公开了 Qwen4 的家族名单。 四个名字:Qwen4-Max、Qwen4-Flash

💡 你将学到

云溪大会Qwen4 一次放出四张牌:Max、Flash、Plus,还有个 27B 留给你本地跑 今天上午,2026 云栖大会在杭州开场。阿里 CEO 吴泳铭上台讲了机器智能时代,随后通义千问负责人刘大一恒第一次公开了 Qwen4 的家族名单。 四个名字:Qwen4-Max、Qwen4-Flash

📜 目录

云溪大会Qwen4 一次放出四张牌:Max、Flash、Plus,还有个 27B 留给你本地跑

今天上午,2026 云栖大会在杭州开场。阿里 CEO 吴泳铭上台讲了机器智能时代,随后通义千问负责人刘大一恒第一次公开了 Qwen4 的家族名单。

四个名字:Qwen4-Max、Qwen4-Flash、Qwen4-Plus、Qwen4-27B。

先把话说清楚,这是预告不是发布

现场关于 Qwen4 只有一张写着 Coming Soon 的幻灯片。参数、跑分、价格、发布时间,一个都没给。官方口径是"基于下一代架构的 Qwen4 已投入训练",Qwen4.5 和 Qwen5 还在规划里。

所以这几天如果看到"Qwen4 参数曝光""Qwen4 跑分出炉"之类的说法,都还不是官方消息。

一边要冲十万亿,一边给你留了个 27B

刘大一恒在台上给了一条参数曲线:千问 2.5 时代的旗舰是 72B,到 Qwen3.8-Max 已经到 2.4T,两年涨了 33 倍。往后 Qwen4.5 和 Qwen5,要推到 5 到 10 万亿参数。

这个数字已经被二手报道传歪了好几轮。有英文站写成"5-10T tokens",有翻译成"5000 亿到 1 万亿"的,还有直接装到 Qwen4 头上的。中文一手口径是参数量 5 到 10 万亿,大约是现在旗舰的 2 到 4 倍,模型本身有多大,阿里没公布。

但同一条名单上还有另一个极端:Qwen4-27B,四款里唯一开源的,明确面向本地部署。四款的分工很清楚:

型号 定位 部署方式
Qwen4-Max 追能力上限 云端
Qwen4-Flash 低成本高速推理 云端 API
Qwen4-Plus 兼顾 API 与私有化 云端 + 企业私有化
Qwen4-27B 开源版本 本地推理

一边是只有巨头玩得起的十万亿参数,一边是留给个人开发者的 27B。这个反差才是这场发布会最有意思的地方。

Qwen4 改了什么,其实已经能跑

Qwen4 的架构不是黑箱。8 月 26 日阿里开源了 Qwen3.8-Flash-Next,官方明确说它就是 Qwen4 架构的技术预览版。

项目 规格
总参数 125B,另加 51B 的 N-gram 嵌入表和 4B 多 token 预测头
每 token 激活 6B
原生上下文 262,144 token,可扩展到 100 万
训练成本 约为 Qwen3.7-Plus 的九分之一
推理定价 每百万输入 1 元、每百万输出 3 元
SWE-bench Pro 62.5,Claude Opus 4.6 是 53.4

关键改动有四处:注意力换成 Gated DeltaNet 和稀疏注意力的混合结构,残差流拆成四条并行分支,用 N-gram 嵌入表把一部分参数从计算里挪出去,优化器换成 Muon 搭配 AdamW。

说白了就是一句话:总参数往上堆,但每个 token 的实际计算量死死压在 6B。这套多参数、少激活的路子,正是 Qwen4 会继承的骨架。

27B 这条线才是被低估的

开发者圈子最兴奋的不是 Max,是 27B。

Qwen3.8-27B 发布两个月,就成了 Hugging Face 历史上点赞最多的模型,超过 DeepSeek R1 和 Llama。上一代 27B 是开源、支持多模态、单张 17GB 显存的显卡就能跑。社区里已经有人清空硬盘等 Qwen4-27B 的量化版,还在追问会不会出面向 Mac 的低资源版本。

阿里这轮晒的生态数据也不小:已经开源 460 多个 Qwen 模型,全球下载超过 30 亿次,衍生模型超过 30 万个,用的人里有 Perplexity、Airbnb、Pinterest 和路透社。

也别急着吹

Qwen3.8-Flash-Next 的短板同样清楚。SWE-bench Pro 上它赢了 Claude Opus 4.6,但在 HLE 上只有 35.9,Opus 4.6 Max 是 40.0;NL2Repo-Bench 上 48.1,不如 DeepSeek-V4-Flash 的 54.2。

也就是说,Agent 和编程任务上它确实强,前沿推理还是差一口气。这个短板能不能在 Qwen4 正式版里补上,现在没有答案。

最后

同一天,平头哥发了新一代 AI 芯片真武 V900,算力是上一代 M890 的三倍,单集群可以扩到 50 万卡,明年一季度量产。吴泳铭给的长期目标是 2032 年阿里云全球数据中心超过 20GW。

把这些拼起来看,阿里的思路是:模型往十万亿参数冲,芯片往 50 万卡堆,云往 20GW 建。而 Qwen4-27B 那一行,是留给开发者自己那张桌子的。

Qwen4 正式版什么时候来,官方没说。但从 Qwen3.8 的节奏看,7 月 19 日预览、8 月 3 日发布、8 月中旬开源权重、8 月 26 日架构预览版,平均两三周就有一个动作。这次的 Coming Soon,应该不会让人等太久。

相关文章
2026-08-06
高盛:资金正在撤离七大科技巨头,半导体才是下一个风口
2026-08-20
Kimi K3 发布三天,美国 AI 圈吵翻了
2026-07-28
京东开源实时视频AI模型,一张RTX 4090就能本地部署

本站文章由编辑人工撰写,收录的工具均经过实测或公开资料核验。文中链接指向工具官网或 GitHub 仓库,仅作信息参考,不构成付费推广。

💬 评论 (0)

暂无评论,来说两句吧~

登录后评论