夜雨聆风学习资料网

ARTICLE · 1090505

AI 工具怎么用才省钱?本周 14 个调整

AI 工具怎么用才省钱?本周 14 个调整

这个月 AI 工具的价格是两头拉:有的降到一成,有的涨了两倍多。四个变化值得记——DeepSeek 下调 Flash 系列定价、DeepSeek 改口继续提供 V4 Pro、智谱的编程订阅套餐大幅上调、阿里 Qoder 给了限时免费额度。下面把它们串起来讲,最后给一套能直接用的省钱方法。

先说清楚一件事:下面的价格都是API 口径(每百万词元/token 计价),不是你开会员的价格。但 API 价格是风向标——它降了,会员和额度迟早跟着动。

变化一:DeepSeek 又降价了,而且分峰谷

9 月 10 日 12 时起,DeepSeek 下调了 V4.1 Flash 的定价。新价格是:闲时输入(缓存命中)0.02 元/百万词元、输入(缓存未命中)1 元、输出 4 元;高峰时段为闲时的 2 倍。

跟上代 V4 Flash 比(闲时缓存命中 0.05、未命中 1.5、输出 4.5),三项降幅分别约60%、33% 和 11%。降得最多的是缓存命中那一项,这不是随便定的——命中缓存意味着你的请求和之前重复,系统不用重新算,成本本来就低。

峰谷定价的机制值得记住:闲时是高峰的一半。如果你有批量任务(比如一次处理几百份文档),挪到夜里跑,账单能差出一半。这是眼下最直接的省钱动作。

变化二:V4 Pro 说不下了

这条挺有意思。9 月 10 日 DeepSeek 发布 V4.1 Flash 时,计划是有序下线 V4 Pro。结果第二天改口:9 月 14 日之后继续提供 V4 Pro 的 API 调用服务。

让公司改变主意的是用户需求。从公开信息看,价格差是主要原因之一——高峰时段每百万输出词元,Flash 收 9 元,Pro 收 27 元,差三倍。有不少场景用户愿意付这个差价换更好的效果。

对我们的意义是:别急着迁移。新模型出来先看两周,很多"要下线"的决定会改口。

图:老周的判断——降价是为抢入口,涨价是为摊成本

变化三:订阅套餐在涨,而且涨得狠

降价的反面是涨价。据中国经济网报道,智谱 8 月把 GLM Coding Plan 的订阅套餐从 Lite 49 元、Pro 149 元、Max 469 元,调整为 Lite 118 元、Pro 538 元、Max 1078 元——三档涨幅分别约 141%、261% 和 130%。

原因不复杂:智能体应用快速增长带来算力压力,长上下文请求高度依赖缓存,推理成本被推高了。有分析师把这轮调价概括为"从卖能力走向卖服务",竞争逻辑正从拼价格转向拼生态。

对我们的意义是:重度用户要开始算单位成本了。以前会员闭眼买,现在同样一项任务,选不同模型的成本差距接近 60 倍——这个数字来自公开测算,指的是模型之间的价差,不是同一家的两档套餐。

变化四:限时免费额度,记得薅

9 月 18 日 10 时起,阿里 Qoder 上线了一个限时活动:在 Qoder 使用 Qwen3.8-Flash 不扣 Credits,免费到 9 月 30 日。另外每天登录还能领 100 通用 Credits,每笔有效期 30 天。活动期间套餐内的额度和领到的奖励可以留给其他模型用。

这类限时福利的特点是窗口短但门槛低。如果你本来就在用这类工具,把重复性的批量任务挪到窗口期跑,能实实在在省一笔。

价格梯队:现在大概是什么水位

档位
代表(输入/输出,元每百万词元)
适合什么
经济型
输入普遍降到 1 元左右
批量、简单、可重试的任务
中间档
MiniMax M3 五折后 2.1 / 8.4
日常主力,性价比区间
旗舰档
Kimi K3 为 20 / 100
复杂推理、长上下文、要质量
限时免费
Qwen3.8-Flash 免费用至 9/30
窗口期内的批量任务

这张表看明白,你就知道该把什么任务交给什么模型了。不是越贵越好,是匹配。

图:本轮调价的四个动作与对你的影响

四条省钱方法,现在就能用

图:AI 账单四步优化(老周整理)

方法一:批量任务挪到闲时。峰谷定价下闲时是高峰的一半,这是零成本收益。适合总结文档、批量翻译、跑数据这类不急的活。

方法二:按难度分档用模型。简单分类、格式化、摘要交给经济型;真正需要推理的长任务再上旗舰档。同样一项任务在不同模型间成本差距接近 60 倍,分档是省钱的大头。

方法三:让上下文可复用。缓存命中的价格只有未命中的几十分之一。实操上的意思是:重复的长提示词固定下来,别每次都改几个字——改动会让缓存失效。

方法四:盯住限时额度,但别为它改工作流。免费窗口适合拿来跑原本就要跑的批量任务,不值得为了薅羊毛临时迁平台——迁移成本通常高于省下的那点钱。

老周的判断

图:本轮调价速查

表面上看矛盾的涨价和降价,其实是同一本账的两面:提价端用峰谷定价引导批量任务往低谷走,摊薄单位算力成本;降价端用贴近边际成本的价格抢占入口。两家都在算同一件事——怎么让算力回报撑得住。

对中国电信研究院那份报告的预测数字,老周持保留态度引用:报告预计 2026 年我国词元年消耗量将达 10 亿亿。量起来了,价格战的空间却在收窄——这意味着单纯靠降价换市场的阶段快过去了。

对我们的实际建议只有一句:别只盯一个工具。把手上的任务分个档,便宜的活给便宜的模型,贵的活才上旗舰。一年下来能省的不是小数目。

数据来源:DeepSeek 开放平台公告、中国经济网、澎湃新闻、腾讯新闻、蓝鲸新闻。各家的会员价格与额度规则以官网公示为准,本文引用的 API 价格为 2026 年 9 月中下旬口径,随时可能调整。

FAQ:三个高频问题

Q1:我是普通用户,API 降价跟我有关吗?有,但是间接的。API 价格是成本底价,它降了,会员价和免费额度通常会跟着松动。更直接可用的是"峰谷"这个思路——批量任务挪到闲时,这个逻辑各家都一样。

Q2:为什么有的涨价有的降价?涨价的是算力吃紧的长上下文和智能体场景,降价的是用来抢入口的经济型模型。同一家公司也可能两头都做——智谱一边上调订阅套餐,一边开源了定价为旗舰版十分之一的 GLM-5.3-Flash。

Q3:现在该囤额度吗?看你的用量是否稳定。用量稳定的重度用户可以趁低价档多备一些;用量不稳定的不建议——模型迭代太快,囤的额度可能还没用完,更好更便宜的新模型就出来了。

价格一个月一变,建议先收藏这篇,下次看到"某模型又调价"的新闻,回来对照看看属于哪一档。

你现在主力用哪一款 AI?是闭眼选一个,还是按任务分档?评论区说说你的用法,老周挺好奇大家的实际选择。

📮 顺手拿走两份资料

• 后台回复 工具,拿《AI 工具速查表》—— 8 个高频场景对号入座

• 后台回复 省钱,拿《AI 账单优化对照表》—— 价格梯队 + 四条省钱方法

• 点底部菜单【领资料】,加读者群,每周一一封 AI 快报

有想让我写的话题,后台留言就行,看得见的都会回。

相关学习资料