DeepSeek发布V4.1 Flash 〜Pro停用,权重不再公开〜

你好,我是上海KEMBO 总经理 CTO 佐々木。

这是今天刚收到的消息。DeepSeek发布了”V4.1 Flash”。新价格已从北京时间2026年9月10日12点起正式生效。同时,V4 Pro将于9月14日12点停用,此后请求将统一路由至V4.1 Flash。

“快速版””专家版””识图”三合一,架构也全面革新

此前DeepSeek一直分为三个版本:常规模式的”快速版(Flash)”、精度更高的”专家版(Pro)”,以及能识别图片的”识图版”(V4-Flash-Vision-Exp,即Vision Exp)。V4.1 Flash把这三者整合成了一个模型。

更大的变化在于多模态处理方式本身的改变。以往的Vision Exp,是在纯文本模型基础上后期加装视觉能力的”扩展包”方式。而V4.1 Flash则从架构层面进行了革新,从一开始就把文本、图像、语音输入一体化处理,采用”原生支持”的方式。模型会自动判断问题的复杂程度以及是否包含图片,并按需启动视觉能力或高阶处理,无需再手动切换模式。上下文长度为100万Token,参数量未公开。

许可协议变了。权重不再公开

这是这次最让我在意的一点。此前的V4系列(Flash、Pro、Vision Exp)都采用MIT许可协议,权重均在Hugging Face上公开。也就是说,可以下载下来放到自己的服务器上运行,也就是所谓的自建部署(self-host)。

V4.1 Flash目前还没有公开这个权重,是一个只存在于DeepSeek官方API上的版本。

这在实际业务中会产生不小的影响。对于有数据出境限制的组织来说,以前即便用不了官方API,也还有把权重下载下来自建服务器,或者使用第三方推理服务这样的退路。而V4.1 Flash,至少在这次的内部测试期间,这条退路实际上被堵死了。

这个方针今后是否会一直持续,还是会有一定时间差后在Hugging Face上公开,目前刚发布还不清楚。不过,”开放权重”原本是DeepSeek的一个特色,这次的动作看起来是朝相反方向迈出了一步,这一点我会持续关注。

价格:相比8月涨价后,反而是降价了

把每百万Token的价格,按闲时、高峰时段列一下(按1美元≈6.7元人民币换算):

模型闲时(输入/输出)高峰时段(输入/输出)
DeepSeek V4.1 Flash(新)¥1/¥4¥2/¥8
DeepSeek V4 Pro(旧・8月调整后)¥4.5/¥13.5¥9/¥27
Claude Haiku 4.5¥6.7/¥33.5(固定)同左
Claude Sonnet 5¥13.4/¥67(固定)同左
Claude Opus 5¥33.5/¥167.5(固定)同左
GPT-5.6 Luna¥0.7/¥4.0(固定)同左
GPT-5.6 Terra¥6.7/¥40.2(固定)同左
GPT-6 Astra¥33.5/¥167.5(固定)同左

和8月涨价之后的价格(V4 Flash单独计算)相比,V4.1 Flash在所有项目上都降价了。不过还没有回到涨价前(输出¥2)的水平,目前仍是当时的2倍。即便如此,相比Claude、GPT里最便宜的档位,依然属于较低价位。

从输出价格来看,是V4 Pro的三分之一,官方称同时连接数是Pro的5倍,看起来DeepSeek是想验证能否做到”以Flash的价格,用到接近Pro的能力”。

来源

结语

我之前在DeepSeek这边,一直是用Pro做统筹调度、Flash做具体执行者。这次听说Flash的性能已经超过了Pro,所以Pro被停用了。以后统一用Flash一个模型就够,价格还是Flash的价格,脑子却是Pro的水平,对我来说是个相当好的消息。

我本来就是通过API使用的,所以现成的环境可以直接接着用。作为一个生活在中国的商务人士,今后我也会继续关注中国的AI动态。