乐于分享
好东西不私藏

本周 AI 圈炸了:DeepSeek 小模型干翻大模型,OpenAI 降价 80%|Java 开发者必读

本周 AI 圈炸了:DeepSeek 小模型干翻大模型,OpenAI 降价 80%|Java 开发者必读

一、前言

7 月 31 日,一个普通周四的下午,DeepSeek 悄悄在 API 文档里更新了一条日志:V4-Flash 正式版开启公测。没有发布会,没有官宣微博,就这么静悄悄地上线了。

结果开发者一测,全炸了:一个激活参数只有 13B 的"小模型",Agent 能力把自家 1.6T 参数的 V4-Pro 预览版按在地上摩擦。同一天,OpenAI 紧急宣布 GPT-5.6 系列降价,Luna 版直降 80%。

这一周(7月24日-8月1日)的 AI 圈,发生了很多足以改变你技术选型的事。作为 Java 后端开发者,这些变化跟你的项目息息相关——DeepSeek API 兼容 OpenAI 协议,你的 Spring AI 项目改一行 base-url 就能用上

今天这篇文章,把本周 AI 大事件全部盘一遍,并且只讲跟 Java 开发者有关的部分。


二、本周四大核心事件速览

事件
时间
一句话总结
跟Java开发者的关系
DeepSeek V4-Flash 正式版发布
7月31日
13B激活参数干翻1.6T的Pro版,Agent能力暴增
改一行配置即可接入,成本降90%
OpenAI GPT-5.6 紧急降价
7月31日
Luna版降价80%,被国产模型逼的
全球大模型价格战开打,受益者是你
阿里 Qwen 3.8 Max 预览
本周
2.4万亿参数多模态巨兽,坚持开源
Spring AI 已支持,通义系再升级
Kimi K3 开源挤爆服务器
本周
史上最大开源权重模型,48小时注册爆满
本地部署/私有化有新选择

本周核心趋势一句话参数竞赛结束了,后训练和Agent能力的竞赛开始了。价格战全面开打,Java开发者的春天来了。


三、事件深读一:DeepSeek V4-Flash——小模型的逆袭

3.1 发生了什么

7月31日下午,DeepSeek 通过 API 文档发布日志宣布 DeepSeek-V4-Flash-0731 正式版 API 上线公测

关键信息:

  • 架构不变:沿用 MoE 稀疏架构,总参数 284B,激活参数仅 13B,与4月预览版结构完全一致
  • 提升全靠后训练:没有堆参数、没有扩算力,纯靠一轮深度后训练微调
  • Agent 能力全面超越自家大哥:9项权威基准测试全部超过 V4-Pro 预览版

3.2 性能数据(重点看这组)

基准测试
V4-Flash 正式版
V4-Pro 预览版
说明
Terminal-Bench 2.1
82.7
72.1
终端指令执行
Agent 终极测试
25.2
15.8
接近 Opus-4.8 的 25.7
NL2Repo
54.2
-
代码仓库转换
Cybergym
76.7
-
网络安全场景
Toolathlon
70.3
-
工具调用
智能指数
50
44
距 GPT-5.6 Luna(51) 仅1分

划重点:小模型打赢大模型,证明了后训练质量 > 参数规模。这意味着你花小模型的钱,能得到接近大模型的 Agent 能力。

3.3 价格(Java 开发者最关心)

项目
DeepSeek V4-Flash
对比参考
输入价格
$0.14/百万token
Anthropic Fable 5: 约$15
输出价格
$0.28/百万token
Anthropic Fable 5: $50
缓存命中
$0.0028/百万token
再降98%
综合成本约为 Anthropic 的 0.6%
-

算一笔账:如果你的 AI 应用每天调用 1000 万 token(中型应用规模):

  • 用 Anthropic Claude:每天约 ¥3,600
  • 用 DeepSeek V4-Flash:每天约 ¥20
  • 一年省下 130 万

3.4 实用特性

  • 双模式切换:思考模式(深度推理)/ 非思考模式(快速响应),按需切换省钱省时
  • 原生支持 Responses API 格式:与 OpenAI 最新 API 格式对齐
  • 适配 Codex:从 OpenAI 工作流迁移几乎零成本
  • MIT 开源权重:即将登陆 HuggingFace,可私有化部署

3.5 重要提醒(迁移截止日期)

DeepSeek 旧版 deepseek-chat 和 deepseek-reasoner 接口已弃用,迁移截止 2026年10月24日。如果你的项目还在用旧接口,必须在10月前完成迁移。


四、事件深读二:OpenAI 降价80%——价格战全面开打

发生了什么

同样是7月31日,OpenAI 紧急下调 GPT-5.6 系列价格:

版本
降幅
定位
GPT-5.6 Luna
降80%
轻量级
GPT-5.6 Terra
降20%
中端
GPT-5.6 Sol
未降
旗舰

上市仅三周就大幅降价,这在 OpenAI 历史上极其罕见。

背后的逻辑

业内共识已经变了:低廉的调用费只是入场券,真正决定模型生死的是 Agent 干活能力

国产模型的打法是:一边压成本(DeepSeek 价格是 OpenAI 的零头),一边猛攻代码和智能体能力(V4-Flash 的 Agent 测试分数逼近顶级模型)。OpenAI 不降不行。

对你的意义

**大模型选型正式进入"性价比时代"**。以前选模型看能力榜,现在要看"能力/价格比"。对 Java 后端来说:

  • 高并发、成本敏感场景 → DeepSeek V4-Flash
  • 复杂推理、代码生成 → GPT-5.6 Sol / DeepSeek V4-Pro(8月中发布)
  • 多模态需求 → Qwen 3.8 Max / Gemini 3.5

五、事件深读三:国产模型集体爆发

阿里 Qwen 3.8 Max 预览

  • 2.4万亿参数,多模态巨兽
  • 坚持开源路线
  • Spring AI 通过 OpenAI 兼容协议可直接接入

Kimi K3 开源

  • 史上最大开源权重模型
  • 发布48小时内注册需求挤爆服务器,被迫暂停注册
  • 私有化部署、企业内网场景的新选择

国产模型全球霸榜

OpenRouter 7月开源模型调用量榜单,前六名全是国产模型

  1. 小米 MiMo-V2.5
  2. DeepSeek V4系列
  3. 腾讯 HY3
  4. MiniMax M3
  5. 智谱 GLM-5.2

全球 Top10 模型中,国产占六席,且价格优势达 **90%-99%**。

政策面

中国首个 AI Agent 约束性规则已于 7月15日生效。做 Agent 应用的企业需要关注合规要求。


六、Java 开发者本周行动清单

基于本周热点,给 Java 后端开发者的具体行动建议:

6.1 立即行动(本周就做)

① 接入 DeepSeek V4-Flash 测试

# Spring AI 项目,改两行配置即可
spring:
ai:
openai:
base-url:https://api.deepseek.com/v1# 改这里
api-key:${DEEPSEEK_API_KEY}# 改这里
chat:
options:
model:deepseek-v4-flash# 新模型名

代码零修改,ChatClient 直接可用。

② 检查旧版 DeepSeek 接口

如果你的项目用了 deepseek-chat 或 deepseek-reasoner,记下迁移截止日:2026年10月24日

6.2 本周关注(持续跟踪)

③ 关注 V4-Pro 正式版(预计8月10-20日发布,SWE-bench Verified 80.6%,编码能力精英级)

④ 评估 Kimi K3 私有化部署(如果你的企业有数据不出内网的硬性要求)

6.3 选型决策更新

场景
本周前推荐
本周后推荐
变化原因
高并发问答
GPT-5.6 Luna
DeepSeek V4-Flash
价格差80%,能力接近
代码生成
Claude Opus
DeepSeek V4-Flash
(临时)
Agent能力追平,等V4-Pro
多模态
GPT-5.6 Sol
Qwen 3.8 Max
(评估中)
2.4T参数+开源
私有化部署
Qwen2.5
Kimi K3
(评估中)
史上最大开源权重

七、延伸拓展

本周的 AI 圈变化,对 Java 开发者全是利好:

  • 价格战 → AI 应用成本大幅降低,以前算不过账的项目现在能做了
  • Agent 能力提升 → 你的 Spring AI 应用不加代码就能变聪明
  • 国产模型崛起 → 国内企业选型不再只有 OpenAI 一个选项

JAVA葵花宝典,每周持续输出 后端AI技术干货。关注不迷路。