产品动态

DeepSeek-V4-Flash API 公测上线:Agent 能力反超 Pro 版,开发者能薅到什么?

DeepSeek 推出 V4-Flash 官方 API 公测,Agent 能力大幅升级,基准测试分数超过 V4-Pro-Preview,并原生支持 Responses API 与 Codex 适配。

本文基于官方公告、公开资料和行业讨论整理,重要事实建议以原文和官方更新为准。
DeepSeek-V4-Flash API 公测上线:Agent 能力反超 Pro 版,开发者能薅到什么?

DeepSeek 官方在 X 平台宣布,V4-Flash 模型的官方 API 正式进入公测阶段。这次更新的重点不是参数堆料,而是 Agent 能力的大幅升级——官方称基准测试分数已显著超过 V4-Pro-Preview。对一直在跟踪 DeepSeek 模型节奏的开发者来说,这是一个有点反直觉的产品动作。

核心升级:Agent 能力

V4-Flash 原本定位是轻量、高速响应,这次却把 Agent 能力当主推卖点,背后逻辑很清晰:DeepSeek 正在把"工具调用 + 多步推理"这类能力下放到更便宜的档位。官方强调 benchmark 远超 V4-Pro-Preview,意味着调用链路的稳定性与多步骤任务完成率,比单纯卷参数更重要。

从产品节奏看,Flash 档通常承担"跑量"角色,主力 Agent 任务此前多落在 Pro 预览版上。这次反超,说明 DeepSeek 在小模型的工程优化跑得比外界预想的快。这与近一年国内开源模型的普遍趋势一致:用更少参数、更高质量数据,做出更"能干活"的模型。

Responses API 与 Codex 适配

值得开发者特别注意的是,V4-Flash 原生支持 Responses API 格式,并已完全适配 Codex。Responses API 是 OpenAI 提出的接口规范,Codex 则是其编码 Agent 工具。这意味着几乎可以零成本把现有 Codex 流水线迁移到 DeepSeek 后端,对国内外的 Agent 框架集成商尤其关键。

对中文用户来说,这条更新的实际意义在于:国内一直缺少"价格低 + 能力强 + 接口规范"三件齐全的 Agent 模型。V4-Flash 把这三件事第一次拼齐。批量任务、自动化脚本、客服机器人都可以先跑 Flash 档而不是上 Pro,成本和延迟同时下降

接入方式上,文档入口已经挂在 api-docs.deepseek.com 的 agent_integrations/codex 路径下,开发者可以直接查看配置示例。公测期间通常伴随价格优惠或额度赠送,但官方未公布具体数字。建议先小流量跑通再上生产,别在公测阶段就把核心业务切过去

几个值得盯紧的后续

  • Flash 档在 Agent 场景下是否有上下文窗口或工具调用次数限制- V4-Pro-Preview 会不会同步降价或被取代- Codex 之外,是否会接入 LangGraph、CrewAI 等主流 Agent 框架

如果这些点陆续补齐,V4-Flash 有可能成为今年下半年Agent 入门首选模型之一

总体来说,这是一次典型的"小模型干大事"更新。对个人开发者和中小团队,V4-Flash 公测是一个值得立刻试用的低成本 Agent 入口;对企业用户,则可以先评估 Agent 任务的稳定性与可控性,再决定是否替换现有方案。别被"Flash"两个字迷惑,它现在的实际能力已经逼近主力模型

同主题阅读路径

查看「产品动态」栏目
继续比较相关工具

读完文章后,如果你想继续筛选 AI 工具,可以从真实使用场景开始做横向比较。

查看 AI 工具