ARTICLE · 1009825
小团队AI算账:5笔月成本压到300元
QUOTE
小团队 AI 的账单大头,从来不是模型贵,是调用习惯贵。
—— 金句先生
老周是家 20 人 SaaS 小公司的老板。上月账单摊在他桌上:大模型 API 三千多、工作流云版订阅四百、代码工具订阅两千八、图片生成一百多——AI 这一摊子合计 ¥5,000 上下。他第一反应不是「涨预算」,是「我是不是哪笔买错了」。
老周缺的不是信息,是算账方法。他把团队 AI 用量拉出来看,发现真正烧钱的从来不是「模型贵」,是「调用习惯贵」:缓存命中从 50% 提到 80%,DeepSeek 闲时月账单直接砍半;峰谷调度再砍一次;订阅席位按人头买,就是第④笔那 ¥2,800 的陷阱。
今天把 20 人小团队、每月 50 万次调用(每次默认 10K 输入 / 1K 输出,另有「轻调用」场景 0.5K 输入 / 0.1K 输出)的成本拆开,五笔逐项算清,最后给一张「压到 300 元档」的决策表。汇率按 USD 1 = CNY 7.0 近似。所有数字来自 2026-09-13 对各家官方价目页的交叉核实,可直接代入你的用量。
本文看点
01
五笔月成本逐项算账
02
一张决策表选路线
03
300 元档的真实落点
01
FIVE COSTS
五笔月成本,逐项算清
先记住公式:月成本 = 调用量 × 每次 tokens × 单价 ÷ 1M × (1 − 命中率 × 闲时折扣杠杆)。五个成本中心:大模型 API、向量库、工作流平台、代码 Agent 订阅、图片生成。
① 大模型 API:闲时 + 缓存,砍到 300 元档
以 DeepSeek V4-Flash 闲时价(缓存命中 $0.007/1M、未命中 $0.22/1M、输出 $0.66/1M,2026-08-17 峰谷制生效):
重调用 50 万次(10K 输入 / 1K 输出、50% 缓存命中、全闲时)= 50 万 × [10K×0.5×0.22 + 10K×0.5×0.007 + 1K×0.66] ÷ 1M ≈ $898 ≈ ¥6,280
轻调用 50 万次(0.5K 输入 / 0.1K 输出、80% 命中、全闲时批处理)= 50 万 × [0.5K×0.8×0.007 + 0.5K×0.2×0.22 + 0.1K×0.66] ÷ 1M ≈ $45 ≈ ¥318——这就是 300 元档
两个杠杆是关键:稳定 system prompt 把缓存命中推到 80%+(官方文档说重复前缀命中率可超过 80%),加上夜间批处理调度避开高峰。
对标海外 GPT-4o-mini(输入 $0.15/1M、缓存读 $0.075/1M、输出 $0.60/1M,128K 上下文):同样 50 万次重调用 ≈ $862 ≈ ¥6,040;轻调用口径也要 ¥446。同等重调用量下两家接近,但 DeepSeek 轻调用档能压到 ¥318,价差约三成。
② 向量库 / RAG:真 · 0 元起步
开源版 Qdrant(Apache-2.0)自托管 0 元,全功能无付费墙;成本 = 你自己的机器
Qdrant Cloud 免费档 0.5 vCPU / 1GB RAM / 4GB 盘,永久免费、不绑卡,约装 25 万条 1536 维向量;开二进制量化(BQ 32× 压缩)可装 700–800 万条
20 人团队日常 RAG 的 50 万次查询不按次计费,落在免费档 1GB 内即 ¥0
量大了再上 Standard $25/月,或自托管 Hetzner VPS(2C4G)≈ ¥35–56/月
结论:你的知识库大概率装得下 25 万向量——这一笔就是 0 元。
③ 工作流平台:自托管 0 元,云版 3 席是陷阱
Dify 开源自托管 0 元,跑团队已有服务器即可,含知识库 RAG、Workflow、Agent,无付费墙
Dify Cloud 云版三档:Sandbox 免费(200 credits、1 成员、5 App,只够试用);Professional $59/工作区/月(5000 credits/月、3 成员、50 App)→ 20 人不够用,要么开 7 个工作区,要么 ¥1,113/月的 Team 档——那是「为 50 人付的钱」,超预算
正确姿势:Dify OSS 自托管(0 元,模型走第①笔的 API key)
④ 代码 Agent 订阅:唯一能烧掉整月预算的一笔
Claude Pro $20/人/月;Max 5x $100/人/月;Max 20x $200/人/月(claude.com 口径,经 2026 第三方席位盘点交叉)
20 席 Pro = $400/月 ≈ ¥2,800/月——比前四笔总和还多 4 倍,这就是老周账单上最大的那一条
正确减法:席位数 = 写码人数,不是团队人数。20 人里 1–3 个写码席位 Pro(¥140–420/月)即可,其余人用第①笔 DeepSeek 便宜档做代码问答/补全
同价位带对照:Cursor Pro $20/人/月、Pro+ $60/月;OpenAI Codex 顶配 $200/月——三条订阅线 20 席全买 = ¥8,400–14,000/月,别买
⑤ 图片 / 杂项:按「张」计费的 47 倍价差
GPT-Image-1 标准 1024×1024 = $0.04/张;GPT Image 1 Mini(Low)= $0.005/张;FLUX schnell = 约 $0.003/张(最便宜档)——价差 47 倍
按 5,000 张/月(月更公众号 + 产品配图 + 素材)算:GPT-Image-1 标准 = $200 = ¥1,400(超预算);GPT Image 1 Mini = $25 = ¥175(可接受);FLUX schnell = $15 = ¥105(进 300 元总盘)
决策:草稿/缩略图走 schnell,对外精修才调 gpt-image-1,混合 5000 张 ≈ ¥150 量级
杂项不单列:向量库备份 $0.03/GB/月、对象存储 100GB 不足 ¥50/月、监控走云厂商免费额度
02
DECIDE
五笔成本决策表:怎么挑
把五笔成本摆到同一张表上,免费档、云 API、自托管三条路线一目了然:
笔
项目
免费档起步
云 API 付费
自建 / 自托管
20 人团队怎么选
①
大模型 API
DeepSeek 免费额度有限,撑不起生产
GPT-4o-mini 每 1M $0.15 / $0.075 / $0.60,50 万次重调用 ≈ ¥6,040
DeepSeek 闲时 + 80% 命中 + 轻调用 ≈ ¥318/月
走闲时 + 缓存批处理
②
向量库
Qdrant Cloud Free 1GB 永久 0 元,装 25 万向量
Qdrant Standard $25/月起
开源自托管 0 元(自己的机器)
不足 25 万向量就用免费档,¥0
③
工作流平台
Dify Sandbox 免费,仅 1 成员 5 App,撑不起
Professional $59/月仅 3 席;Team $159/月
Dify OSS 自托管 0 元,全功能无付费墙
自托管,0 元
④
代码 Agent
无免费生产档
Claude Pro $20/人/月,20 席 = ¥2,800/月
—
席位 = 写码人数,1 席 ≈ ¥140/月
⑤
图片生成
GPT Image Mini $0.005/张、FLUX schnell 约 $0.003/张
GPT-Image-1 $0.04/张,5000 张 = ¥1,400
schnell + Mini 混合 ≈ ¥105–175/月
草稿走 schnell,精修才 Mini
表:五笔成本决策表(可直接截图转发老板)

— 五笔成本并列示意:API / 向量 / 工作流 / Agent / 图片,一条下降曲线贯穿
这张表可以直接截图转发给老板——「按人头买订阅」的陷阱(第④笔 ¥2,800)和「0 元档」的正确姿势(②③ 笔)都在这。
03
SEVEN STEPS
七步把账单压到 300 元档
顺序很重要:先盘点,再按笔动刀,先动 ① 和 ④ 这两个大钱口。
盘点五笔 把大模型 API、向量库、工作流、代码 Agent、图片五条线的全月费用摊出来,标出「哪笔买错了」。
第①笔切闲时 + 缓存 DeepSeek V4-Flash 闲时价(命中 $0.007 / 未命中 $0.22 / 输出 $0.66 每 1M),稳定 system prompt 把命中推到 80%+,夜间批处理调度。
第①笔按量级选档 日常轻调用(0.5K 入 / 0.1K 出)走 300 元档;确需 10K/1K 的重调用单独批,别混着算。
第②笔用 Qdrant 免费档 1GB 永久免费不绑卡,20 人知识库远不到 25 万向量,¥0 起步。
第③笔 Dify OSS 自托管 一台 4C8G 服务器即可,0 元;云版 Professional 只 3 席,20 人别碰。
第④笔按写码人数买席位 Claude Pro 1 席(全职写码岗)≈ ¥140/月,3 席 ≈ ¥420;非写码岗走第①笔便宜档。
第⑤笔混合图片档 草稿/缩略图 FLUX schnell(约 $0.003/张),对外精修才 GPT Image Mini($0.005/张),5000 张压在 ¥105–175。
04
NUMBERS
量化收益:到底省多少
把上面的动作代入数字,给三档真实落点,对号入座:
口径 A:3 个写码岗的 20 人团队(轻调用 50 万次 + 3 席 Pro + schnell 混合)= ① ¥318 + ② ¥0 + ③ ¥0 + ④ ¥420 + ⑤ ¥140 ≈ ¥878/月
压一档:① 调用减半(50 万 → 25 万次轻调用,¥159),④ 3 席不变,总盘 → ¥719/月
压二档:④ 只留 1 个全职写码席位(¥140,其余人走 ① 便宜档),① 仍 25 万次,总盘 → ¥439/月
严格 300 元档:① 轻调用 20 万次(¥127)+ ④ 1 席(¥140)+ ⑤ 3,000 张纯 schnell(¥63)= ¥330——这就是「300 元档」的真实落点
相对老周原始 ¥5,000 级账单,省 93%;杠杆按顺序叠加
注意双口径:若你做的是 50 万次「重调用」(10K/1K),仅 ① 一笔 DeepSeek 闲时就要 ¥6,280、GPT-4o-mini 要 ¥6,040——300 元档对应「轻调用 + 减量 + 减席」组合,先对号入座再代入。
∞
THE END
下一步
今天只做一件事:把五笔费用摊开,对照上面的决策表,圈出 2 处「按人头买订阅」或「没走闲时/缓存」的错配。
改这两处,第 ① 笔月账单砍一半,第 ④ 笔砍到 ¥140。跑通一周后,再决定是否补上 夜间批处理调度 这一层。
互动投票:你的 AI 月账单现在大概? A. ¥300 内 B. ¥300–3,000 C. ¥3,000 以上 D. 还没算过
SEED COMMENT
我们 20 人团队上个月光订阅就 ¥4,000,按这篇把席位砍到 3 个、图片切 schnell,这周账单 ¥360。
RELATED
1. 小团队 AI 成本优化实操
2. DeepSeek 闲时定价与缓存命中
3. Dify 自托管与向量库免费档选型
我是金句先生,专注 AI 应用落地与降本提效的实战观察。
如果你觉得今天这篇有收获,欢迎点赞、在看、转发三连,我们下篇见。