9月9日,DeepSeek开放平台发布通知,计划于北京时间2026年9月10日前后正式发布V4.1 Flash模型。
经内部及外部多方测试,V4.1 Flash在性能、费用、速度、总用时等各项指标上已全面超越V4 Pro。
发布前一日,DeepSeek已在官方交流群内开启了V4.1 Flash中间版本内测。据参与内测的用户反馈,新模型采用了全新的模型结构,原生支持多模态,能力更强、速度更快、成本更低。内测期间,开发者将模型名设置为“deepseek-v4.1-flash-expires-on-0910”即可调用,计费与现有V4 Flash相同,每账号限流20并发。
一个值得注意的细节是:在V4.1 Flash正式上线之后、V4.1 Pro上线之前,DeepSeek会将原本发送给V4 Pro的请求全部路由至V4.1 Flash,并按照V4.1 Flash的单价计费。这意味着用户将在V4.1 Pro正式发布前,以更低价格体验到性能超越V4 Pro的模型服务。
这一路由切换也释放出两个信号:V4.1 Flash很可能将阶段性取代V4 Pro成为API用户默认的主力模型;同时,V4.1 Pro的存在也意味着DeepSeek还有后续新模型正在准备中。
Flash系列大幅降价
与模型发布同步的,是Flash系列的价格调整。
9月9日,DeepSeek在开放平台发布公告,宣布从9月10日12时起正式下调Flash系列模型调用价格。调整后,空闲时段输入缓存命中价格由每百万Token 0.05元降至0.02元,降幅60%;输入缓存未命中价格由1.5元降至1元,降幅约33%;输出价格由4.5元降至4元,降幅约11%。高峰时段价格为空闲时段价格的两倍。此次调价涉及deepseek-v4-flash和deepseek-v4-flash-vision-exp两款模型。
此次降价的背景颇为微妙——距离DeepSeek上次涨价还不到一个月。8月13日,DeepSeek V4 Pro正式版上线时,API价格曾大幅上调,其中V4 Pro系列最高涨幅达11倍。当时的涨价引发了不少开发者的议论,认为DeepSeek的“性价比”优势不再。如今Flash系列降价,有市场声音认为是对此前涨价的“部分回调”。与8月涨价前相比,Flash系列的缓存命中和未命中输入价格已回到此前的0.02元和1元,但输出价格仍由此前的2元上涨至4元。
有开发者根据自身Agent工作流估算,综合调用成本可能下降约40%,实际降幅仍取决于缓存命中率、输入输出Token占比等因素。

秘密启动科创板IPO筹备
在V4.1 Flash发布和降价之外,DeepSeek的资本动向同样值得关注。
9月9日,据21世纪经济报道等多家媒体消息,DeepSeek已聘请中信证券筹备在上海证券交易所科创板上市,计划年内启动IPO流程。知情人士向媒体证实该消息属实,目前中信证券已与DeepSeek方面接洽并进入尽职调查阶段,但双方尚未签订正式的上市辅导协议。具体募资规模、发行时间和目标估值均未最终确定。
据媒体报道,DeepSeek已于6月完成了首轮融资,市场多将总融资规模计为500亿元至510亿元。创始人梁文锋或出资约200亿元,为最大单一出资方;腾讯出资约100亿元,宁德时代体系出资约50亿元。市场预估公司投后估值约500亿美元。
此前,DeepSeek曾因API价格频繁调整引发市场关注——8月6日宣布计划整体上调API定价,8月17日新价生效后市场普遍反馈实际使用价格远高于调价之前。如今V4.1 Flash的发布和降价,以及为科创板IPO的筹备动作,正在为这家AI大模型公司打开新的局面。
(素材来自:DeepSeek 智算芯能前沿网综合)
本文由智算芯能前沿网编辑整理,转载请注明出处。
