7 月 31 日 DeepSeek 上线 V4-Flash 正式版 API 公测,仅重做后训练、不改模型架构,综合能力直接超越自家 V4-Pro 预览版。
核心亮点
硬件架构不变,性能质变
MoE 混合专家架构,原生支持100 万超长上下文,开源权重采用 MIT 许可,企业可私有化部署;仅优化后训练,代码、智能体跑分全面跃升:
Terminal Bench 2.1:82.7 分,终端运维能力拉满
DeepSWE 代码仓库测试:7.3→54.4,涨幅超 7 倍
Agent 综合测试 25.2 分,逼近海外顶级模型 Opus-4.8
完美兼容 OpenAI 生态,迁移零成本
原生支持 Responses API 格式,针对性适配 Codex,可直接接入 VSCode 插件、Codex CLI、OpenCode Go 等编程工具;老用户只需替换模型名deepseek-v4-flash即可切换新版本。
成本优势突出,长文本性价比拉满
百万上下文大幅降低超长文档、代码仓库处理开销,开源商用无限制,对开发团队、AI 智能体项目极度友好;官方透露旗舰 V4-Pro 正式版也将很快推出。
适用场景
✅ AI 代码生成、全栈开发、代码智能体
✅ 超长文档分析、知识库本地私有化部署
✅ 自动化运维、终端脚本、工具调用代理
不靠堆参数,仅靠后训练优化实现性能反超;兼容 Codex + 百万上下文 + 开源商用,开发者搭建 Agent、编程工具新平替来了!