一、前言
7 月 31 日,一个普通周四的下午,DeepSeek 悄悄在 API 文档里更新了一条日志:V4-Flash 正式版开启公测。没有发布会,没有官宣微博,就这么静悄悄地上线了。
结果开发者一测,全炸了:一个激活参数只有 13B 的"小模型",Agent 能力把自家 1.6T 参数的 V4-Pro 预览版按在地上摩擦。同一天,OpenAI 紧急宣布 GPT-5.6 系列降价,Luna 版直降 80%。
这一周(7月24日-8月1日)的 AI 圈,发生了很多足以改变你技术选型的事。作为 Java 后端开发者,这些变化跟你的项目息息相关——DeepSeek API 兼容 OpenAI 协议,你的 Spring AI 项目改一行 base-url 就能用上。
今天这篇文章,把本周 AI 大事件全部盘一遍,并且只讲跟 Java 开发者有关的部分。
二、本周四大核心事件速览
| 改一行配置即可接入,成本降90% | |||
本周核心趋势一句话:参数竞赛结束了,后训练和Agent能力的竞赛开始了。价格战全面开打,Java开发者的春天来了。
三、事件深读一:DeepSeek V4-Flash——小模型的逆袭
3.1 发生了什么
7月31日下午,DeepSeek 通过 API 文档发布日志宣布 DeepSeek-V4-Flash-0731 正式版 API 上线公测。
关键信息:
架构不变:沿用 MoE 稀疏架构,总参数 284B,激活参数仅 13B,与4月预览版结构完全一致 提升全靠后训练:没有堆参数、没有扩算力,纯靠一轮深度后训练微调 Agent 能力全面超越自家大哥:9项权威基准测试全部超过 V4-Pro 预览版
3.2 性能数据(重点看这组)
| 82.7 | |||
| 25.2 | |||
| 54.2 | |||
| 76.7 | |||
| 70.3 | |||
| 50 |
划重点:小模型打赢大模型,证明了后训练质量 > 参数规模。这意味着你花小模型的钱,能得到接近大模型的 Agent 能力。
3.3 价格(Java 开发者最关心)
| $0.14/百万token | ||
| $0.28/百万token | ||
| $0.0028/百万token | ||
| 综合成本 | 约为 Anthropic 的 0.6% |
算一笔账:如果你的 AI 应用每天调用 1000 万 token(中型应用规模):
用 Anthropic Claude:每天约 ¥3,600 用 DeepSeek V4-Flash:每天约 ¥20 一年省下 130 万
3.4 实用特性
双模式切换:思考模式(深度推理)/ 非思考模式(快速响应),按需切换省钱省时 原生支持 Responses API 格式:与 OpenAI 最新 API 格式对齐 适配 Codex:从 OpenAI 工作流迁移几乎零成本 MIT 开源权重:即将登陆 HuggingFace,可私有化部署
3.5 重要提醒(迁移截止日期)
DeepSeek 旧版 deepseek-chat 和 deepseek-reasoner 接口已弃用,迁移截止 2026年10月24日。如果你的项目还在用旧接口,必须在10月前完成迁移。
四、事件深读二:OpenAI 降价80%——价格战全面开打
发生了什么
同样是7月31日,OpenAI 紧急下调 GPT-5.6 系列价格:
| 降80% | ||
上市仅三周就大幅降价,这在 OpenAI 历史上极其罕见。
背后的逻辑
业内共识已经变了:低廉的调用费只是入场券,真正决定模型生死的是 Agent 干活能力。
国产模型的打法是:一边压成本(DeepSeek 价格是 OpenAI 的零头),一边猛攻代码和智能体能力(V4-Flash 的 Agent 测试分数逼近顶级模型)。OpenAI 不降不行。
对你的意义
**大模型选型正式进入"性价比时代"**。以前选模型看能力榜,现在要看"能力/价格比"。对 Java 后端来说:
高并发、成本敏感场景 → DeepSeek V4-Flash 复杂推理、代码生成 → GPT-5.6 Sol / DeepSeek V4-Pro(8月中发布) 多模态需求 → Qwen 3.8 Max / Gemini 3.5
五、事件深读三:国产模型集体爆发
阿里 Qwen 3.8 Max 预览
2.4万亿参数,多模态巨兽 坚持开源路线 Spring AI 通过 OpenAI 兼容协议可直接接入
Kimi K3 开源
史上最大开源权重模型 发布48小时内注册需求挤爆服务器,被迫暂停注册 私有化部署、企业内网场景的新选择
国产模型全球霸榜
OpenRouter 7月开源模型调用量榜单,前六名全是国产模型:
小米 MiMo-V2.5 DeepSeek V4系列 腾讯 HY3 MiniMax M3 智谱 GLM-5.2
全球 Top10 模型中,国产占六席,且价格优势达 **90%-99%**。
政策面
中国首个 AI Agent 约束性规则已于 7月15日生效。做 Agent 应用的企业需要关注合规要求。
六、Java 开发者本周行动清单
基于本周热点,给 Java 后端开发者的具体行动建议:
6.1 立即行动(本周就做)
① 接入 DeepSeek V4-Flash 测试
# Spring AI 项目,改两行配置即可
spring:
ai:
openai:
base-url:https://api.deepseek.com/v1# 改这里
api-key:${DEEPSEEK_API_KEY}# 改这里
chat:
options:
model:deepseek-v4-flash# 新模型名
代码零修改,ChatClient 直接可用。
② 检查旧版 DeepSeek 接口
如果你的项目用了 deepseek-chat 或 deepseek-reasoner,记下迁移截止日:2026年10月24日。
6.2 本周关注(持续跟踪)
③ 关注 V4-Pro 正式版(预计8月10-20日发布,SWE-bench Verified 80.6%,编码能力精英级)
④ 评估 Kimi K3 私有化部署(如果你的企业有数据不出内网的硬性要求)
6.3 选型决策更新
| DeepSeek V4-Flash | |||
| DeepSeek V4-Flash | |||
| Qwen 3.8 Max | |||
| Kimi K3 |
七、延伸拓展
本周的 AI 圈变化,对 Java 开发者全是利好:
价格战 → AI 应用成本大幅降低,以前算不过账的项目现在能做了 Agent 能力提升 → 你的 Spring AI 应用不加代码就能变聪明 国产模型崛起 → 国内企业选型不再只有 OpenAI 一个选项
JAVA葵花宝典,每周持续输出 后端AI技术干货。关注不迷路。
夜雨聆风