当前位置:首页>AI资讯>DeepSeek-V4-Flash 正式版 API 开启公测:Agent能力大幅提升,原生适配Codex

DeepSeek-V4-Flash 正式版 API 开启公测:Agent能力大幅提升,原生适配Codex

2026年7月31日,DeepSeek 宣布 DeepSeek-V4-Flash 正式版 API 开启公测。开发者无需修改原有调用方式,只需继续使用 deepseek-v4-flash 模型名称,即可调用升级后的 DeepSeek-V4-Flash-0731。

DeepSeek-V4-Flash 正式版 API 开启公测:Agent能力大幅提升,原生适配Codex

本次更新主要围绕智能体与代码任务进行了强化。DeepSeek 公布的测试结果显示,V4-Flash 正式版在 Terminal Bench 2.1、NL2Repo、DeepSWE、Toolathlon Verified、Agent Last Exam 等多项 Agent 与代码基准中取得明显提升,并在部分测试中超过此前的 V4-Pro Preview。

值得注意的是,DeepSeek-V4-Flash-0731 没有调整模型架构和参数规模,仍与此前的 V4-Flash Preview 保持一致,性能提升主要来自重新进行的后训练。这意味着 DeepSeek 在不扩大模型规模的情况下,进一步增强了模型的工具调用、任务规划、代码修改和长程执行能力。

DeepSeek-V4-Flash 正式版还原生支持 Responses API,并针对 OpenAI Codex 进行了适配。目前,开发者可以将其接入 Codex CLI、ChatGPT 桌面端以及 VS Code 中的 Codex IDE 扩展。上述 Codex 客户端共用同一份配置文件,完成一次配置后即可在不同客户端中选择 DeepSeek-V4-Flash。

DeepSeek 同时表示,V4-Flash 在公开代码 Agent 测试中使用了即将发布的 DeepSeek Harness 极简模式。该框架主要用于为模型提供终端操作、代码编辑、工具调用和任务验证环境,相关内容将在后续公布。

在模型规格方面,DeepSeek-V4-Flash 支持思考与非思考两种模式,提供100万Token上下文窗口,最大输出长度达到38.4万Token,并支持工具调用、JSON输出、Anthropic API和Responses API。

当前API价格为:缓存命中的输入每百万Token 0.0028美元,缓存未命中的输入每百万Token 0.14美元,输出每百万Token 0.28美元。DeepSeek还计划实施峰谷定价机制,具体生效时间以之后的公告为准。

需要注意的是,本次更新仅涉及 DeepSeek-V4-Flash API。DeepSeek-V4-Pro API以及DeepSeek网页端、App端模型暂未发生变化。DeepSeek表示,V4-Pro正式版将很快发布,并计划在2026年8月初加入Responses API与Codex支持。

豆包AI助手
©版权声明:如无特殊说明,本站所有内容均为AIHub.cn原创发布和所有。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。否则,我站将依法保留追究相关法律责任的权利。