DeepSeek新模型两天限时内测,速度飞起但有个坑
下午刷到个消息,DeepSeek悄悄开了个新模型的限时内测,叫V4.1 Flash中间版本。看名字就知道有意思:deepseek-v4.1-flash-expires-on-0910,9月10号自动过期,就给你两天体验时间,这是明摆着的限时体验卡。
我是搞开发的,正在做接入大模型的小程序,看到这消息立马去翻了翻细节,说几个值得注意的点。
先说速度,网上已经有人晒出实测了,输出速度冲到过每秒507个token。有博主做了同任务对比:SVG代码生成快了6倍,长文档检索快了5.2倍,大型SQL生成快了5倍。这个量级的提速,体感上就是按回车的一瞬间答案已经吐完了。
再说个挺重要的变化:这是DeepSeek头一款原生多模态模型。之前的Vision版本属于外挂式,在纯文本底座上接了个视觉模块。这次是出厂自带图文能力,结构整个换新的。官方问卷里甚至有一道题问开发者:它能不能替换线上的V4 Pro?这个信号值得琢磨。
价格倒是没涨,内测计费跟V4 Flash一样:空闲时段每百万token输出4.5元,高峰9元。
但是想尝鲜的朋友注意三个坑。头一个,单账号限流20并发,正式版Flash可是2500,差着一百多倍,拿它做功能验证可以,想扛线上流量想都别想。第二个,9月10号接口直接下线,千万别把业务搭上去。第三个坑是我自己算账算出来的:单价没降,但速度快了意味着同样的时间烧掉的token多了好几倍,已经有开发者反馈账单没降反升。官方说的成本更低,指的是底层推理效率,能不能落到你的账单上,得自己测。
我的建议:这两天拿它跑跑自己的真实任务,把速度和token消耗都记下来,跟现在用的模型对比一下,等正式版上了心里就有数了。
你试了吗?速度体感怎么样,评论区聊聊。
