9月10日,DeepSeek V4.1 Flash模型正式上线国家超算互联网中心,用户登录官网进入“模型服务”页面即可调用API。
该模型为552B参数的MoE模型,采用全新Causal-Encoder-Decoder结构,输入激活仅8B、输出激活16B,成本显著低于同尺寸模型。
经新预训练方式和大规模强化学习后训练,其智能水平超越DeepSeek V4 Pro等旗舰模型。
此外,模型大幅压缩KV Cache,HBM需求降至上一代1/4、SSD降至1/8,显著降低Agent类任务使用成本。
9月10日,DeepSeek V4.1 Flash模型正式上线国家超算互联网中心,用户登录官网进入“模型服务”页面即可调用API。
该模型为552B参数的MoE模型,采用全新Causal-Encoder-Decoder结构,输入激活仅8B、输出激活16B,成本显著低于同尺寸模型。
经新预训练方式和大规模强化学习后训练,其智能水平超越DeepSeek V4 Pro等旗舰模型。
此外,模型大幅压缩KV Cache,HBM需求降至上一代1/4、SSD降至1/8,显著降低Agent类任务使用成本。