7月31日,DeepSeek-V4-Flash正式版API悄然上线公测,标志着这家国产大模型公司在Agent赛道上迈出关键一步。与以往"Pro强、Flash弱"的分层逻辑不同,此次更新后,Flash正式版在多项Agent基准测试中的表现已逼近甚至超越三个月前的V4-Pro预览版。
官方数据显示,V4-Flash正式版在Terminal Bench2.1上取得82.7分,Cybergym达76.7分,Toolathlon verified为70.3分。值得注意的是,该模型总参数2840亿,激活参数仅130亿,与V4-Pro(激活490亿)相差近一个数量级。DeepSeek明确表示,此次更新"仅重新进行了后训练",模型结构完全不变。这意味着,通过训练方法和数据质量的优化,轻量模型在特定任务上正缩小与旗舰模型的差距。

此次升级的另一看点,是自研Agent框架DeepSeek Harness首次以正式命名亮相。同时,V4-Flash原生支持OpenAI力推的Responses API格式,并针对性适配Codex,开发者可低成本将OpenAI生态的Agent应用迁移至DeepSeek平台。
战略意图十分清晰:用高性价比的轻量模型切入Agent应用市场。Agent场景对推理速度和成本极度敏感,Flash的低价优势在反复调用工具的多轮任务中将形成显著竞争力。
此次发布距离DeepSeek完成超500亿元首轮融资不足两月,公司估值已攀升至约710亿美元。在资本加持下,DeepSeek正加速从"不融资不上市"转向商业化冲刺。随着Pro正式版即将到来,Agent战争的大幕已然拉开。