🚀 DeepSeek-V4-Flash 正式版于 2026 年 7 月 31 日上线!
🔹 模型标识: deepseek-v4-flash
🔹 上下文长度: 1M(100万 Token)
🔹 Agent 能力: 较 V4-Pro-Preview 显著提升
🔹 API 适配: 原生支持 OpenAI Responses API,专为 Codex 优化适配
V4-Flash 是 DeepSeek V4 系列的高效轻量模型,在保持极高性价比的同时,智能体能力得到大幅强化,是日常 Agent 工作流的理想选择。
核心特性
智能体能力升级
V4-Flash 在 Agent 编码任务、工具调用、多步骤规划等方面相比 V4-Pro-Preview 版本有明显提升,能够更好地完成复杂的自动化工作流,包括代码编写、调试、文件操作等真实工程任务。
1M 超长上下文
延续 V4 系列的 1M 上下文标准,V4-Flash 同样支持百万级 Token 上下文窗口,能够处理超长文档、大型代码仓库和复杂多轮对话。
OpenAI Responses API 原生支持
V4-Flash 原生兼容 OpenAI Responses API 格式,开发者可以更便捷地集成到现有工作流中。
Codex 一键适配
针对 Codex 智能体编码场景进行了专门优化,支持一键配置接入 Codex 工作流,为 AI 辅助编程提供强有力的模型支持。
API 接入方式
保持 base_url 不变,将模型名称设置为 deepseek-v4-flash 即可使用。支持 OpenAI ChatCompletions API 以及新增的 Responses API。
V4-Flash 与 V4-Pro 共同构成 DeepSeek V4 正式版产品线,为不同需求场景提供灵活选择:V4-Flash 适合追求速度和成本效益的日常 Agent 任务,V4-Pro 适合需要顶级推理能力的复杂任务。