近日有爆料称,DeepSeek计划于9月发布全新大模型DeepSeek Code 2.0,参数量超过3万亿,性能目标直指Mythos 5.1与GPT-6 Astra,并有望实现超越。若消息属实,这将是国产大模型在参数规模与性能上的一次重要冲击。
该模型延续DeepSeek一贯的开源策略,重点聚焦Computer Use(电脑控制)能力,可替代用户直接操作电脑完成多项工作任务,进一步向“AI智能体”方向迈进。这一功能被视为大模型从对话工具走向实际生产力的关键一步。
从参数规模看,3万亿在国内属顶尖水平,远超K3的2.8万亿、千问Qwen 3.8 Max的2.4万亿以及DeepSeek V4 Pro的1.6万亿。业内认为,更大的参数量是冲击性能上限的必要条件,也为复杂任务处理和多模态能力提供支撑。
此外,DeepSeek本周还低调更新了DeepSeek Flash,其架构接近V5但未更换版本号;Pro系列新品则确认为V4.1 Pro。不过,上述爆料的可信度尚待验证,用户期待值不宜过高,最终信息仍需以官方发布为准。
