
7 月 31 日,DeepSeek 宣布,V4-Flash 正式版 API 开启公测,模型版本更新为 V4-Flash-0731,开发者沿用原有名称即可调用,无需更换接口。

这次更新中另一个受到关注的动作,是 DeepSeek 首次原生支持 Responses API,并针对 Codex 进行了适配。
Responses API 是 OpenAI 用于统一处理模型输出、推理过程和工具调用的接口格式,也是 Codex 客户端与模型交互的主要接口。
适配完成后,开发者可以在 Codex CLI、ChatGPT 桌面端和 VS Code 的 Codex 插件中,将模型提供方配置为 DeepSeek。也就是说,OpenAI 自家的编程客户端,现在可以直接运行竞争对手的模型。
价格延续了 DeepSeek 一贯的打法。V4-Flash 每百万输入 token 定价 0.14 美元,输出 0.28 美元,缓存命中的输入仅 0.0028 美元,上下文长度 1M。按普通开发者的日常用量估算,一天的编程开销不足一元人民币。

便宜的 Flash,跑分反超了贵的 Pro
V4-Flash-0731 的架构和参数规模与预览版一致,变化在于重新进行了后训练,重点改善代码修改、工具调用和多步骤任务执行等 Agent 能力。
官方公布的数据显示,它在九项智能体、代码和自动化基准中的整体成绩,已明显高于定价更高的 V4-Pro 预览版,其中 Terminal Bench 2.1 得分 82.7,DeepSWE 得分 54.4。

第三方评测给出了相近的结论。Artificial Analysis 在 7 月 31 日更新的智能指数测试中,给 V4-Flash-0731 打出 50 分,同类可比模型的中位数为 17 分。

评测同时暴露了一个成本细节,V4-Flash-0731 在测试中共生成 2.1 亿个 token,可比模型的中位数为 6200 万,输出量明显偏高。在按量计费的模式下,实际支出取决于消耗总量,单价只是其中一个变量。
此外,DeepSeek 即将实行峰谷计价,北京时间每天 9 点至 12 点、14 点至 18 点为高峰时段,价格为平时的两倍,具体生效时间以官方公告为准。
市场反应快于预期。由于权重开放,海外已有开发者购入两台英伟达 Spark,在本地完整运行该模型。免费的公共调用端点也已出现。数天前刚宣布上调价格的国产同类产品,则面临直接的比价压力。

溢价结构的变化,不止发生在编程
编程工具是这轮变化中最先被触及的品类,但相同的逻辑正在向所有 AI 应用蔓延。对出海团队而言,这次适配是一个具有普遍意义的信号。
主流 AI 编程工具的订阅费通常在每月 20 美元上下,其中相当一部分对应的是模型能力,订阅工具即获得前沿模型的使用权。接口标准统一之后,这层绑定开始松动。当一个评测 50 分的模型以每百万 token 零点几美元的价格开放接入,依靠转售模型能力获取差价的空间被大幅压缩。

这个判断可以直接推广,任何以「用我的产品等于用上好模型」作为主要卖点的 AI 应用,无论做的是编程、写作、客服还是内容生成,都会被同样的价格锚重新衡量。
变化对出海团队同时是两件事。成本端是利好,推理价格下探意味着毛利空间扩大,省下的开支可以转化为海外市场的定价优势。竞争端是警示,模型能力正在失去稀缺性,产品之间的差异要在模型之外重新建立。
行业的应对方向也随之清晰。产品层面的竞争重心,正在移向模型难以替代的部分,对用户场景的理解、工作流的顺畅程度决定留存;私有化部署、权限审计、SOC 2 等合规认证构成企业级收入,这部分与底层模型无关,反而最为稳定;深度嵌入客户业务流程或日常工具链的产品,替换成本高于节省的模型开支,形成实际的护城河。
架构设计上,在产品中预留模型切换能力已成为普遍选择。上游价格变动可以转化为成本优势,而与单一模型深度绑定的产品,则需要被动承受每一次上游调价。
这场价格竞争仍在进行中。按官方预告,V4-Pro 的 Responses API 支持将在 8 月上旬加入。模型成本持续下降的趋势下,AI 产品的价值构成正在被市场重新定价。

MIST Ai 持续关注 AI 产品的成本结构与商业化,正在出海的 AI 团队,欢迎来聊。


好文分享 戳个在看

夜雨聆风