【国盛计算机】DeepSeek V4.1 Flash发布,揭示降本新解法
[太阳]9月10日,DeepSeek发布DeepSeek V4.1 Flash,该模型为552B参数的MoE模型,具备原生多模态视觉理解能力,多项测评结果显示其模型智能体能力已进入全球前沿模型梯队,并且采用全新架构使模型成本进一步降低。
[太阳]模型定价上,V4.1 Flash依托创新架构,实现定价下调。V4.1 Flash沿用峰谷定价,空闲时段,每百万Tokens输入1元/输出4元,缓存命中输入0.02元,而V4 Flash为每百万Tokens输入1.5元/输出4.5元,缓存命中输入0.05元。V4.1 Flash采用了全新的Causal-Encoder-Decoder结构,输入和输出不对称,输入激活只有8B,输出激活16B,成本显著低于已知的同尺寸模型,此外模型大幅减少了KV Cache 缓存的大小,与上一代模型相比,对 HBM 的需求减少到 1/4,对 SSD的需求减少到1/8。
[太阳]模型能力上,V4.1 Flash刷新DeepSeek模型能力上限,多项测试接近Kimi K3、Opus 5等全球前沿模型。根据官方披露的19项测评结果中,V4.1 Flash有14项结果超过DeepSeek V4 Pro;在智能体综合基准评测结果中,V4.1 Flash在DeepSWE v1.1(软件工程)、CyberGym(网络安全)、Automation-Bench(通用自动化)三项测评中得分超过Kimi K3、GLM 5.3、Opus 5、GPT 5.6 Sol,仅在Terminal-Bench 3.0(终端复杂任务)中得分低于Opus 5、GPT 5.6 Sol。
[太阳]我们认为,V4.1 Flash以架构创新推动模型降本,并实现模型能力显著提升,验证该路径提升模型性价比的有效性,模型性价比有望加速迈入Agent规模化可用区间,从而打开大模型商业化空间。建议关注具备前沿模型研发能力的大模型厂商以及算力产业链相关公司。
大模型:智谱、Minimax;
国产算力:寒武纪、海光信息;
算力租赁:东阳光、宏景科技。
风险提示:技术迭代不及预期风险;经济下行超预期风险;行业竞争加剧风险