《阿里把压箱底的开源了!Qwen3.8-Max 正式发布:2.4万亿参数,史上首次开放 Max 级权重》
还记得那个"最强国产模型只能云端调用,想自己部署?门都没有"的时代吗?就在昨天,这个规矩被阿里亲手打破了。
8月3日,阿里通义千问正式发布 Qwen3.8-Max——2.4 万亿参数的新一代旗舰模型。更炸裂的是:这是阿里历史上第一次,把 Max 级模型的权重开源。不是"即将",不是"考虑",是白纸黑字承诺:下周上 Hugging Face 和 ModelScope。
一句话:全球开发者很快就能下载一个 2.4 万亿参数的模型,跑在自己的服务器上。一年前,这想都不敢想。
一、2.4T 到底是个什么概念?
2.4 万亿参数,直接冲进国产大模型第一梯队:Kimi K3 是 2.8T,GLM-5.2 约 1T,DeepSeek V3 是 671B。它还带 100 万 token 超长上下文——把《三体》三部曲全喂进去,它都能记住前因后果。
但别被"2.4T"吓到。它是 MoE(混合专家)架构,单次推理实际只激活 95B 参数。总参数决定你下载占多大硬盘,激活参数才决定跑起来多烧钱。它不是"贵到只有大厂用得起",而是"普通人也能摸一摸"的旗舰。
二、为什么"开源 Max 级权重"是历史性动作?
回想一下:Qwen3.6-Max、Qwen3.7-Max,一代比一代强,但全是"只给 API、不给权重"——想私有化部署?没门。整个 Max 系列,一直是闭源的。
这次 Qwen3.8-Max 打破惯例,一次性把 Max 和 Qwen3.8-27B(轻量版)一起开源。对开发者的意义:
1. 可以本地部署,数据不出内网——政企客户狂喜
2. 可以微调、蒸馏、魔改,不再受 API 限制
3. 可以拿最强国产模型当底座做自己的产品这波明摆着是回应 Kimi K3——月之暗面 7 月 17 日发布 2.8T 的 K3,7 月 27 日就开源了权重。阿里再端着,开源社区人心就全跑了。这次不只是"发模型",是"表态"。
三、它能干什么?干长活!
官方数据很硬:PaperBench 93.0、GPQA Diamond 92.6、OSWorld 真实电脑操作 86.1,全是顶级水准。但真正离谱的是它的"长跑能力":
• 连续 16 天自主编程,无人值守
• 500 轮芯片设计优化
• 365 天电商运营模拟
• 公开案例:从空文件夹开始,10 天自己写完一个 AI 编程助手,攒下 265 次提交、127 个 PR以前的模型是"你问一句、它答一句";Qwen3.8-Max 是"你给个目标、它自己干半个月"。这才是 Agent 时代模型该有的样子。
四、普通人能怎么用?
1. 等下周权重上线(Hugging Face + ModelScope 同步),有显卡的直接部署
2. 用官方 API:国内 12 元/百万输入、36 元/百万输出,缓存命中只要 1.5 元——比不少小模型还便宜
3. Token Plan 订阅:39 元/月起,还能用全家桶多模态模型最后说句公道话:"仅次于 Fable 5"目前还是官方自评,第三方榜单还没验证。但不管排名怎么排,一个 2.4T 参数的模型能让你自己下载部署,这件事本身就够写进 2026 大模型编年史了。
国产大模型"万亿俱乐部"已经开卷:Kimi K3 开源了,Qwen3.8-Max 也要开源了,据说 DeepSeek V4、MiniMax M3 Pro 都在路上。接下来一个月,好戏连台。
你猜,下一个开源万亿级模型的会是谁?评论区聊聊你的看法!


