9月9日,DeepSeek在其开放平台发布通知,计划于北京时间9月10日前后正式推出新一代模型V4.1 Flash。
据官方披露,经内部及多方外部测试,V4.1 Flash在性能、响应速度、计算费用及总处理用时等核心指标上,均已全面超越此前的V4 Pro模型。
在价格方面,DeepSeek将于9月10日中午12时起执行Flash系列新定价,进一步扩大其性价比优势。
调整后,每百万Token输入(缓存命中)在空闲时段收费0.02元,高峰时段0.04元;缓存未命中时,空闲时段1元,高峰时段2元;输出Token在空闲时段为4元,高峰时段为8元,高峰时段价格均为空闲时段的两倍。作为对比,此前高峰时段每百万输出Token,Flash收费9元,Pro收费27元,新价格降幅明显。
值得一提的是,DeepSeek同时宣布,基于对用户负责的考量,在V4.1 Flash正式上线之后、V4.1 Pro问世之前,平台将对所有指向V4 Pro的API请求自动路由至V4.1 Flash处理,并按照Flash系列的更低单价计费。这一安排意味着现有V4 Pro用户无需任何代码修改,即可获得性能更强的模型服务,且支付成本反而下降,在行业内属于较为罕见的“升级降价同步”策略。
记者注意到,此前V4.1 Flash已经开放有限范围内测,据其官方介绍称,该模型采用全新架构并原生支持多模态,能力更强、速度更快、成本更低。
从目前网上社区参与测试的用户反馈显示,其生成速度约达每秒284个Token,相较于目前的V4模型约为每秒97个Token,速度提升近两倍。尤其对需要频繁迭代的编程场景具有显著实用价值。
并且,在内测同步发放的问卷中,官方明确询问用户该模型能否全面替代线上运行的V4 Pro,足见其对V4.1 Flash的定位不仅限于迭代Flash系列,更希望以Flash的定价和速度逼近甚至达到Pro级别的能力。
目前该测试版本名称带有“expires-on-0910”标识,暗示其将在后续下线。因此,正式版的表现成为当前市场关注的焦点。
(来源:上海证券报微信公众号)





