你好,我是上海KEMBO 总经理 CTO 佐々木。
这是今天刚收到的消息。DeepSeek发布了”V4.1 Flash”。新价格已从北京时间2026年9月10日12点起正式生效。同时,V4 Pro将于9月14日12点停用,此后请求将统一路由至V4.1 Flash。
“快速版””专家版””识图”三合一,架构也全面革新
此前DeepSeek一直分为三个版本:常规模式的”快速版(Flash)”、精度更高的”专家版(Pro)”,以及能识别图片的”识图版”(V4-Flash-Vision-Exp,即Vision Exp)。V4.1 Flash把这三者整合成了一个模型。
更大的变化在于多模态处理方式本身的改变。以往的Vision Exp,是在纯文本模型基础上后期加装视觉能力的”扩展包”方式。而V4.1 Flash则从架构层面进行了革新,从一开始就把文本、图像、语音输入一体化处理,采用”原生支持”的方式。模型会自动判断问题的复杂程度以及是否包含图片,并按需启动视觉能力或高阶处理,无需再手动切换模式。上下文长度为100万Token,参数量未公开。
许可协议变了。权重不再公开
这是这次最让我在意的一点。此前的V4系列(Flash、Pro、Vision Exp)都采用MIT许可协议,权重均在Hugging Face上公开。也就是说,可以下载下来放到自己的服务器上运行,也就是所谓的自建部署(self-host)。
V4.1 Flash目前还没有公开这个权重,是一个只存在于DeepSeek官方API上的版本。
这在实际业务中会产生不小的影响。对于有数据出境限制的组织来说,以前即便用不了官方API,也还有把权重下载下来自建服务器,或者使用第三方推理服务这样的退路。而V4.1 Flash,至少在这次的内部测试期间,这条退路实际上被堵死了。
这个方针今后是否会一直持续,还是会有一定时间差后在Hugging Face上公开,目前刚发布还不清楚。不过,”开放权重”原本是DeepSeek的一个特色,这次的动作看起来是朝相反方向迈出了一步,这一点我会持续关注。
价格:相比8月涨价后,反而是降价了
把每百万Token的价格,按闲时、高峰时段列一下(按1美元≈6.7元人民币换算):
| 模型 | 闲时(输入/输出) | 高峰时段(输入/输出) |
|---|---|---|
| DeepSeek V4.1 Flash(新) | ¥1/¥4 | ¥2/¥8 |
| DeepSeek V4 Pro(旧・8月调整后) | ¥4.5/¥13.5 | ¥9/¥27 |
| Claude Haiku 4.5 | ¥6.7/¥33.5(固定) | 同左 |
| Claude Sonnet 5 | ¥13.4/¥67(固定) | 同左 |
| Claude Opus 5 | ¥33.5/¥167.5(固定) | 同左 |
| GPT-5.6 Luna | ¥0.7/¥4.0(固定) | 同左 |
| GPT-5.6 Terra | ¥6.7/¥40.2(固定) | 同左 |
| GPT-6 Astra | ¥33.5/¥167.5(固定) | 同左 |
和8月涨价之后的价格(V4 Flash单独计算)相比,V4.1 Flash在所有项目上都降价了。不过还没有回到涨价前(输出¥2)的水平,目前仍是当时的2倍。即便如此,相比Claude、GPT里最便宜的档位,依然属于较低价位。
从输出价格来看,是V4 Pro的三分之一,官方称同时连接数是Pro的5倍,看起来DeepSeek是想验证能否做到”以Flash的价格,用到接近Pro的能力”。
来源
- DeepSeek V4.1 Flash:DeepSeek官方邮件(2026年9月10日收到)
- DeepSeek V4 Pro(8月调整):techtimes.com
- Claude各模型:Claude官方文档
- GPT各模型:OpenAI官方文档
- 架构与许可协议:BigGo Finance
结语
我之前在DeepSeek这边,一直是用Pro做统筹调度、Flash做具体执行者。这次听说Flash的性能已经超过了Pro,所以Pro被停用了。以后统一用Flash一个模型就够,价格还是Flash的价格,脑子却是Pro的水平,对我来说是个相当好的消息。
我本来就是通过API使用的,所以现成的环境可以直接接着用。作为一个生活在中国的商务人士,今后我也会继续关注中国的AI动态。


