9月10日,深度求索发布新系列最小模型DeepSeek V4.1 Flash,原生支持多模态视觉理解。
该模型采用552B参数MoE架构与Causal-Encoder-Decoder结构,KV Cache大幅压缩,HBM需求降至上代1/4,推理成本显著降低。
官方测试显示其多项表现超越V4 Pro,已上线API,模型名改为“deepseek-flash”即可调用,旧版V4 Flash与V4 Flash Vision Exp已下线。
官方计划有序下线V4 Pro:9月14日12:00后请求将自动路由至V4.1 Flash并按新价格计费,API同步启用峰谷定价,闲时价为高峰一半。
