阿里直接把 2.4 万亿参数旗舰开源了
阿里千问今天扔了个重磅炸弹:Qwen3.8-2.4T-A95B 正式开源,权重全面开放。
这是阿里第一次把 Max 级别的旗舰模型向全球开发者放开,不是阉割版,是正儿八经的旗舰。
参数有多夸张?
总参数 2.4 万亿,每个 Token 激活 950 亿。原生支持 26 万 Token 上下文,还能扩展到 101 万。这个规模在开源圈基本是降维打击。
底层架构延续 Qwen3.5 优势,但在编程、日常办公、科研辅助、长周期智能体任务上做了全方位升级。
具体看 benchmark。PaperBench 论文复现基准和 OSWorld-Verified 电脑操作评估里,成绩排在参评模型前列,部分指标超过多款国际主流模型。
最值得关注的是长周期自主工作能力。模型能独立完成长达数天的复杂编程任务,还能自主复现并优化研究论文。不是写个函数就断片的水平,是真能扛长程任务。
这意味着什么?以前开源模型能做的大多是短任务、单轮问答,长程 Agent 一直是闭源旗舰的地盘。现在阿里把这个能力开源了,开发者可基于它做自己的 Agent 系统,不用再依赖 API。
部署方面也考虑到了。支持多种主流推理引擎高效部署,生态团队还用量化技术大幅压缩存储体积,本地部署门槛降低不少。
现在开源大模型竞争已进入 "旗舰级" 阶段。以前开源的都是 7B、70B 级别,旗舰模型捂着不卖。现在阿里直接把 2.4 万亿的 Max 模型放出来,等于把开源天花板又拉高一大截。
对开发者是天大的好事。以前想做长程 Agent、复杂编程、科研辅助这些场景,只能用闭源 API,成本高、数据还得出域。现在有了开源旗舰,可本地部署、二次微调、深度定制,想象空间大很多。
对整个行业来说,这会进一步挤压中间层模型的生存空间。当 2.4 万亿的旗舰都开源了,几百亿参数、能力不上不下的模型,处境会越来越尴尬。
Qwen 系列一直是开源圈主力,从 7B 到 72B 再到现在的 2.4T,路线很清晰:用开源生态绑定开发者,用模型能力吸引企业,最后靠云服务赚钱。
大模型竞争,正在从 "谁的模型强" 变成 "谁的生态强"。开源是最快建立生态的方式,阿里这次算是把油门踩到底了。
接下来就看其他厂商怎么接招了。开源旗舰化趋势,已经挡不住。
阿里巴巴 阿里 大模型 AI 科技 人工智能

