新模型发布
DeepSeek V4-Flash正式版公测:Agent能力暴涨7.5倍,MIT开源碾压全行业定价
2026年7月31日下午,DeepSeek通过API文档发布日志宣布DeepSeek-V4-Flash正式版API上线公测。模型结构与预览版完全一致——总参数约2840亿、激活约130亿、支持100万Token上下文窗口——仅重新进行了后训练。但Agent能力出现质的飞跃:DeepSWE基准从预览版的7.3飙升至54.4,涨幅达7.5倍;Terminal Bench 2.1达到82.7,逼近Claude Opus 4.8的水平;NL2Repo达54.2,Cybergym达76.7。
定价方面,V4-Flash保持行业最低水平:每百万输入Token仅1元人民币、输出2元,缓存命中时低至0.02元。这一价格远低于OpenAI同日降价的GPT-5.6 Luna(约1.4元/百万输入Token),在性价比上形成碾压态势。正式版原生支持Responses API格式并针对性适配Codex,开发者可通过DeepSeek开放平台直接接入。模型权重以MIT许可证开源,允许商业使用。
同日,DeepSeek宣布乌兰察布扩建1GW算力基地,为模型推理和后续训练提供算力保障。DeepSeek V4-Pro正式版将"尽快"发布。社区热议称这是"新的DeepSeek时刻"——纯靠后训练和Agent框架优化而非扩大参数规模,就实现了Agent能力的跨越式提升,证明了中国AI公司在工程化能力上的独特优势。对开发者而言,V4-Flash的极低定价加上MIT开源,将进一步压缩闭源API的商业空间,加速AI能力的普惠化进程。