昊梵体育网

DeepSeek 官宣 V4-Flash-0731:没换架构、没换芯片,只重新做

DeepSeek 官宣 V4-Flash-0731:没换架构、没换芯片,只重新做了一次后训练,就在 Terminal-Bench 上从 61.8 分涨到 82.7 分,反超自家旗舰 V4-Pro-Preview(72.1);DeepSWE 从 7.3 飙到 54.4(Pro 为 12.8)。

「模型越高效,GPU 越卖不动」的说法,这次反而被证伪了:能力增长确实来自软件,但规模化部署仍然吃显存带宽——NVFP4 下约 160GB 显存,单张 H100(80GB)放不下。推理是带宽的游戏:tok/s ≈ 带宽 ÷ 模型大小。模型变小让单次调用便宜,便宜让需求扩大,总算力消耗反而更高。这轮真正加速的,是推理价格的军备竞赛,不是 GPU 的终结。

你觉得「效率越高,GPU 卖得越少」这个逻辑,接下来会被证实还是证伪?