DeepSeekV4 多模态模型正式开源 刚刷到 DeepSeek 的新动作,直接把DeepSeek-V4-Flash-Vision-Exp 放上 Hugging Face 开源了,还是 MIT 协议,这波诚意直接拉满。
这次真不是挤牙膏式开源,模型文件、Tokenizer、Prompt Encoding 参考实现,连最小化 PyTorch 推理实现一并放出,视觉编码器、Aligner、DFlash Attention、MoE 这些核心模块也全覆盖到,开发者拿到手就能直接上手研究、做二次开发。
按官方的定位,这是 V4 家族第一款实验性多模态模型,在原先 V4-Flash 的架构基础上加了视觉模块,相当于把原本的文本、推理、Agent 能力全保留,又补上了图像理解这块能力。
不得不说国产大模型现在开源卷得是真扎实,从文本到多模态持续放干货,开发者圈这下又有新玩具可以折腾了,坐等各路大神整出新奇玩法。
