含有AI生成内容
中美AI工具价格战白热化,打工人选型大变局
GPT-5.6 Luna降价80%撞上DeepSeek-V4-Flash正式版上线,同一天智谱涨价261%——2026年8月的第一周,AI定价体系正在被重写

▲ 中美AI价格战:美元与人民币的定价碰撞
一、你的AI工具账单,这个月变了吗?
如果你是一个每天用AI写代码、写方案、做分析的打工人,过去一周你的微信群里大概率出现了这样的对话:
"GPT降价了你知道吗?Luna直接打两折!""DeepSeek新出的Flash正式版,跑一次代码审查才一毛二!""智谱涨价了你看了吗?Pro档从149涨到538,翻了快三倍!"
一边是OpenAI把入门模型降价80%,一边是DeepSeek悄无声息上线正式版把成本再压60%,同一天智谱却把Coding Plan月费最高涨了261%。同一天,有人挥刀自宫砍80%,有人逆势涨价261%。AI定价正在K型分化——基础能力白菜化,差异化能力反而敢要溢价。
对于25到35岁的职场人来说,这不是遥远的商业新闻。你用Cursor写代码、用ChatGPT改方案、用Claude做分析,每个月的AI订阅费可能已经从几十块涨到了几百块。现在价格表又变了,你到底该用哪个?续费还是换工具?这篇文章帮你一次算清楚。
二、三件大事同时发生,定价逻辑彻底改写
1. OpenAI挥刀:Luna降价80%,三周就打脸
7月30日,OpenAI宣布GPT-5.6系列API大幅降价。距离该系列7月9日发布,仅过去了21天。
具体降价幅度:入门级Luna输入价从每百万Token 1美元降至0.2美元(约1.35元人民币),输出价从6美元降至1.2美元(约8.1元),降幅80%;中端Terra降价20%,输入2美元、输出12美元;旗舰Sol价格不变(输入5美元、输出30美元),但新增2.5倍速Fast模式,价格翻倍。
据36氪和量子位报道,OpenAI官方将降价归因于GPT-5.6 Sol参与自身生产系统优化——重写GPU内核使服务成本下降20%,推测解码优化让Token生成效率提升15%以上。但观察者网的分析直接质疑:20%的成本优化撑不起80%的降价幅度,真正的原因是竞争压力。
OpenAI总裁布罗克曼在X上直言:"Luna现在显然是同级别中最具性价比的模型。"Replit总裁称其为"最接近便宜到不值得计价的智能"。
2. DeepSeek亮剑:V4-Flash正式版,成本再低60%
就在OpenAI降价的同一天——7月31日,DeepSeek悄无声息地在API文档里更新了一行日志:V4-Flash正式版开启公测。没有发布会,没有预热推文。
但数据很炸裂。据CSDN深度拆解和新浪科技报道,V4-Flash总参数2840亿,激活参数仅130亿,通过纯后训练优化(架构和参数完全没变),Agent能力实现飞跃:DeepSWE基准从预览版的7.3分飙升至54.4分,暴涨超6倍;Terminal Bench 2.1拿到82.7分,超过GLM-5.2,逼近Claude Opus 4.8的85分。
定价方面,V4-Flash平时输入1元/百万Token(缓存命中仅0.02元),输出2元,高峰期翻倍。关键数字:缓存命中率约98%,命中与未命中输入价差达50倍。官方数据显示,V4-Flash单任务成本比刚降价80%的GPT-5.6 Luna还低约60%。
开发者实测:让Flash阅读一个12万行的Python仓库,找出所有未处理异常并生成修复PR,总成本约0.12元。同样的任务用Claude Opus 4.8跑,成本约25元。价差超过200倍。
据每日经济新闻报道,在OpenRouter最新周榜上(7月27日至8月2日),DeepSeek-V4-Flash以7.22万亿Token周调用量登顶全球第一,中国模型连续14周霸榜,前五名全部是中国产品。GPT-5.6 Luna降价后首次上榜,位居第八,周调用量1.95万亿Token,环比增长456%。
3. 智谱逆势涨价:Coding Plan最高涨261%
同样是7月30日,智谱宣布GLM Coding Plan重新开放订阅,但价格全面上调:Lite从49元涨到118元(+141%),Pro从149元涨到538元(+261%),Max从469元涨到1078元(+130%)。计费方式从按prompt次数改为透明积分制,工作日14-18点高峰期按3倍扣额。
据网易智能报道,智谱并非第一次涨价。2026年Q1,GLM系列API价格已累计上调约83%,但调用量反而增长了400%。付费开发者超过24.2万。智谱CEO张鹏的逻辑是"从干活中来"——企业级智能体业务收入同比增长248.8%,高质量Token是稀缺资源。
三件事撞在同一天,指向一个结论:AI模型定价已经K型分化。基础推理能力加速商品化,价格逼近"厘时代";而真正有差异化能力的高端模型和订阅服务,反而可以要溢价。

▲ 中美主要大模型API价格对比(纵轴为对数刻度,数据来源:各厂商官方定价,2026年8月)
三、一张表看清:中美模型价差到底有多大
以下表格汇总了2026年8月主流模型的API定价(人民币,按1美元≈6.8元换算),按输入价格从低到高排列:
模型 | 厂商/国别 | 输入(元/百万Token) | 输出(元/百万Token) | 缓存命中(元) |
DeepSeek V4-Flash | DeepSeek/中国 | 1.0 | 2.0 | 0.02 |
GPT-5.6 Luna | OpenAI/美国 | 1.36 | 8.16 | 0.34 |
DeepSeek V4-Pro | DeepSeek/中国 | 3.0 | 6.0 | 0.025 |
豆包2.1 Turbo | 字节/中国 | 3.0 | 15.0 | 0.6 |
豆包2.1 Pro | 字节/中国 | 6.0 | 30.0 | 1.2 |
GLM-5.2 | 智谱/中国 | 8.0 | 28.0 | 2.0 |
GPT-5.6 Terra | OpenAI/美国 | 13.6 | 81.6 | 3.4 |
GPT-5.6 Sol | OpenAI/美国 | 34.0 | 204.0 | 8.5 |
Claude Opus 4.8 | Anthropic/美国 | 119.0 | 595.0 | — |
从表格可以看出三个关键事实:
第一,最便宜的DeepSeek V4-Flash与最贵的Claude Opus 4.8,输入价差达119倍,输出价差达297倍。这还不是极限——如果算上Flash 98%的缓存命中率(实际输入成本低至0.02元),实际价差可以超过5000倍。
第二,OpenAI降价后的Luna(输入1.36元)确实已经低于DeepSeek V4-Pro的标准输入价(3元),但Flash凭借缓存机制,在高频重复场景下的实际成本仍然碾压Luna。
第三,国产模型并非全线便宜。GLM-5.2的输入8元、输出28元,已经高于DeepSeek V4-Pro,豆包2.1 Pro的输出30元也与Luna的8元形成数倍差距。"国产=便宜"正在变成一个过时的刻板印象。
再看2026年上半年国内API价格下调的密度:据证券日报统计,5月22日DeepSeek V4-Pro永久降价75%;5月27日小米MiMo-V2.5最高降幅99%;6月3日腾讯云DeepSeek系列降价97.5%;6月12日腾讯云第二轮调价;6月23日字节豆包2.1发布,综合成本比Claude低80%;7月31日DeepSeek V4-Flash正式版上线、OpenAI Luna降价80%。不到三个月,至少6轮密集降价,国内大模型API正式进入"厘时代"。
四、打工人选型指南:照着这张表选就对了
价格对比看完了,关键问题是:你到底该用哪个?以下按使用场景给出具体建议。
编程开发场景
日常补全和简单CRUD:DeepSeek V4-Flash + Cline/OpenCode(免费开源客户端),月成本可控制在30元以内。Flash在Terminal Bench拿到82.7分,日常编码完全够用。
中型项目日常开发:GPT-5.6 Luna via Codex(ChatGPT Plus $20/月,约145元)。降价后Luna的额度购买力大幅提升,有开发者测算每周可以用Luna构建100个完整应用。
复杂重构和架构设计:Claude Code(Claude Pro $20/月或Max $100-200/月)仍然是最强选择。在SWE-bench等硬核基准上,Claude Opus系列的代码理解和长链路推理能力仍有优势。
注意:智谱GLM Coding Plan涨价后Pro档538元/月,已经接近Claude Max($100≈680元),如果你能稳定使用海外服务,性价比需要重新评估。但老用户V2套餐(149元/月)建议继续续费锁定价格。
写作与内容创作场景
中文写作和翻译:豆包2.1 Turbo(火山方舟Lite套餐40元/月)或DeepSeek V4-Flash。中文自然度高,成本极低。
长文写作和创意内容:Claude Opus 4.8或Kimi K3(开源免费可本地部署)。长上下文理解和文笔质感仍然是旗舰模型的护城河。
日常邮件、方案、PPT文案:GPT-5.6 Luna完全够用,配合ChatGPT Plus订阅即可。
数据分析场景
批量数据处理和分类打标:DeepSeek V4-Flash,配合缓存命中策略,500万输入+50万输出的成本约5元。
复杂SQL生成和数据洞察:豆包2.1 Pro或GPT-5.6 Terra,在结构化推理和代码生成上表现更稳定。
深度分析报告:GPT-5.6 Sol或Claude Opus 4.8,这一档不能省。

▲ 打工人AI工具场景选型矩阵:星级越高越推荐
月费成本计算器:三档预算方案
预算档位 | 月费 | 推荐组合 | 适合人群 |
极限省钱 | 0-50元 | DeepSeek V4-Flash API + Cline/OpenCode(免费)+ 通义灵码(免费) | 学生、入门开发者、轻度使用者 |
性价比之选 | 150-250元 | ChatGPT Plus($20,含Codex/Luna)+ 火山方舟Lite(40元)+ DeepSeek Flash按量 | 大多数程序员、产品经理、运营 |
重度专业 | 500-1500元 | Claude Max($100-200)+ ChatGPT Plus + 豆包Pro备用 | 资深工程师、技术负责人、高频Agent用户 |
省钱核心原则:80%的日常任务用Flash/Luna档就够了,只有20%的硬核任务才需要旗舰模型。用旗舰模型跑轻量任务,就像开法拉利送外卖——能到,但油钱比餐费还贵。把系统Prompt和常用模板放在前面保持前缀不变以触发缓存,批量任务安排在非高峰时段,可以再省50%-97%。
五、价格战走向:三个判断
判断一:旗舰不降价,轻量继续杀
GPT-5.6的三档策略已经给出了明确信号:Sol(旗舰)不降反增Fast模式收费,Terra(中端)小降20%,Luna(轻量)暴跌80%。这个分层逻辑会被全行业跟进——Anthropic的Claude Opus 5已经推出半价Low模式,谷歌Gemini 3.6 Flash主打比Kimi K3更便宜。未来12个月,轻量模型价格还会再降50%以上,但旗舰模型价格基本不会松动。
判断二:订阅制和API按量计费长期并存
智谱涨价261%但调用量反增400%,说明高强度用户对订阅制有真实需求——每天消耗几十亿Token的重度开发者,按量计费的账单可能远超固定月费。据钛媒体报道,有开发者通过Codex套餐一周花费300元就能处理120亿Token,同等Token量用GLM API需要数千元。订阅制卖的不是Token,是"不看账单的安心感"。未来会有更多厂商推出分层订阅,同时保留API按量选项。
判断三:选型从"选最强"变成"选最划算"
据CNBC报道,美国企业通过OpenRouter调用中国模型的Token占比已从4.5%暴涨至46%。Jefferies全球股票策略主管Christopher Wood警告,中国开源模型可能对美国AI投资造成"大规模资本毁灭"。当DeepSeek V4-Flash以Claude Fable 5约1/105的运行成本完成同等智能水平的任务(据Artificial Analysis数据),"品牌忠诚度"正在被"每日报价"取代。对打工人来说,这意味着你的工具栈应该是多模型组合而非单一绑定——日常用Flash,复杂任务切Sol/Claude,根据每天的价格和性能灵活切换。
价格战还远没有结束。OpenAI已经秘密提交IPO申请,年亏损预计140亿美元;DeepSeek正筹备IPO,ARR达4-5亿美元且毛利率超50%;智谱半年内四次调价。当"便宜到不值得计价"的智能遇上"高质量Token是稀缺资源"的定价自信,2026年下半年的AI市场,只会更热闹。
最后一句实在话:别当等等党,也别盲目追新。今晚花半小时检查你的AI订阅,把80%的日常任务切到Flash或Luna,省下的钱足够多订一个旗舰服务啃那20%的硬骨头。价格战的红利窗口不会永远开着——能用白不用。
数据来源:OpenAI官方公告(2026.7.30)、DeepSeek API文档、Artificial Analysis Intelligence Index v4.1、OpenRouter周榜(2026.8.3)、每日经济新闻、36氪、量子位、证券日报、IT之家、火山引擎官方定价、CSDN开发者实测。本文含有AI生成内容,定价数据截至2026年8月4日,请以各平台最新价格为准。
夜雨聆风