DeepSeek-V4-Flash 正式版发布

🚀 DeepSeek-V4-Flash 正式版于 2026 年 7 月 31 日上线!

🔹 模型标识: deepseek-v4-flash 🔹 上下文长度: 1M(100万 Token) 🔹 Agent 能力: 较 V4-Pro-Preview 显著提升 🔹 API 适配: 原生支持 OpenAI Responses API,专为 Codex 优化适配

V4-Flash 是 DeepSeek V4 系列的高效轻量模型,在保持极高性价比的同时,智能体能力得到大幅强化,是日常 Agent 工作流的理想选择。

核心特性

智能体能力升级

V4-Flash 在 Agent 编码任务、工具调用、多步骤规划等方面相比 V4-Pro-Preview 版本有明显提升,能够更好地完成复杂的自动化工作流,包括代码编写、调试、文件操作等真实工程任务。

1M 超长上下文

延续 V4 系列的 1M 上下文标准,V4-Flash 同样支持百万级 Token 上下文窗口,能够处理超长文档、大型代码仓库和复杂多轮对话。

OpenAI Responses API 原生支持

V4-Flash 原生兼容 OpenAI Responses API 格式,开发者可以更便捷地集成到现有工作流中。

Codex 一键适配

针对 Codex 智能体编码场景进行了专门优化,支持一键配置接入 Codex 工作流,为 AI 辅助编程提供强有力的模型支持。

API 接入方式

保持 base_url 不变,将模型名称设置为 deepseek-v4-flash 即可使用。支持 OpenAI ChatCompletions API 以及新增的 Responses API。

V4-Flash 与 V4-Pro 共同构成 DeepSeek V4 正式版产品线,为不同需求场景提供灵活选择:V4-Flash 适合追求速度和成本效益的日常 Agent 任务,V4-Pro 适合需要顶级推理能力的复杂任务。

ESC

输入关键词开始搜索

支持搜索标题、内容、标签