【DeepSeek V4.1 Flash模型正式发布】9月10日,DeepSeek正式发布DeepSeek V4.1 Flash模型。
据了解,DeepSeek官方已向API用户发送通知邮件,宣布DeepSeek于北京时间2026年9月10日正式发布V4.1 Flash模型并执行新的Flash定价。
同时,DeepSeek计划推迟至北京时间2026年9月14日12:00下线V4 Pro服务,届时DeepSeek V4 Pro将会路由到V4.1 Flash并按V4.1 Flash计费。
经内部、外部多方测试,V4.1 Flash在性能、费用、速度、总用时等各项指标上已全面超越V4 Pro。
V4.1 Flash的价格于北京时间2026年9月10日12:00开始生效:
空闲时段输入缓存命中单价0.02元、输入缓存未命中单价1元,输出单价4元;高峰时段价格为空闲时段价格的2倍。
高峰时段是指北京时间周一至周五9:00-12:00、14:00-18:00(其余为空闲时段)。
这是公司全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。其大幅减少了KV Cache缓存的大小:与上一代模型相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent使用场景中,缓存命中的费用往往占比较高,对KV Cache的压缩大幅降低了Agent类任务的使用成本。

