姐妹们,上周有个做副业的朋友,差点又给OpenAI充了20刀。
我说你先等等。不是不让你花钱,是这钱完全可以晚点花。
截止2026年8月21日,我实测了一圈,能直接拿来跑AI的免费额度,一共16家。国内5家,国际7家,连注册都不用的还有4条。
今天这篇,帮你把这16家捋清楚,按场景对号入座,别看见GPT就掏卡。
先上地图:三条线
我不一上来就甩参数表。参数好看,不等于你今天就能用上。
我会拆成三条线:
• 国内平台:注册就能上手,中文场景最稳 • 国际平台:模型更大、上下文更长,但门槛也高 • 免注册通道:临时试模型可以,别当生产力工具
金句就一句:免费额度不是越强越好,是你今晚能不能用上。
国内5家:今天下午就能跑起来
1. 阿里云千问 —— 新用户1亿+tokens
新用户直接送1亿+tokens,qwen3全家桶都能跑。

这份见面礼够你把日常对话、写代码、小批量评测先顶过去。老用户就别眼红了,这是新号专享。
适合谁:还没开通过阿里云账号的姐妹
2. 智谱GLM-4.7-Flash —— 永久免费
这条有点狠:永久免费。
200K上下文、128K输出,带深度思考和工具调用。注册就能用,不强制实名。
你要是做中文Agent、要工具调用、又不想被实名卡住,先看它。
适合谁:想长期白嫖中文AI的开发者
3. 火山方舟 —— Agent开发者必看
开通Managed Agents,送30小时Agent运行时+500次联网搜索,有效期2年。
每个月还送2万次。
你要是在做会上网的Agent,别只盯着对话tokens,运行时和联网次数才是真会烧钱的地方。
适合谁:做智能体、需要联网功能的开发者
4. 硅基流动 —— 速度党首选
Qwen3-8B永久免费,1000 RPM。速度这块国内算能打的。
⚠️ 注意:从2026年5月15日起要实名认证。想继续白用,先把认证做了。
适合谁:对速度有要求、愿意实名的用户
5. 魔搭ModelScope —— 模型最多
挂着56个免费模型。其中Qwen3.5-35B每天2000次。

代价是绑定阿里云实名。模型多、适合换着玩;额度按天切,别拿它当24小时生产网关。
适合谁:喜欢尝鲜、想试不同模型的玩家
国际7家:模型更大,路更绕
国际这边参数确实更刺激,但也更绕。部分平台对账号地区、手机号、支付方式有要求。开得了就开,开不了就换下一家。
6. Google Gemini —— 长文档神器
Flash系列支持1M上下文。谷歌已经不对外公布限额了,以控制台实际配额为准。
你要处理长文档、一本书扔进去那种任务,先看Flash。
适合谁:需要处理超长文本的用户
7. Groq —— 速度之王
能跑gpt-oss-120b、qwen3.6-27b。限额30 RPM/每天1000次,邮箱注册。
速度是真快,快到你第一次用会怀疑是不是没推理完。适合打草稿、快速试prompt。
适合谁:追速度、需要快速验证想法的开发者
8. Mistral —— 写代码首选
新账号每月送$10额度。Medium 3.5(128B)、Codestral都能跑。
你要是写代码多,Codestral这条比去跟通用聊天模型死磕划算。
适合谁:程序员、需要AI辅助写代码的开发者
9. Cohere —— 大模型体验
Command A+(218B)每月1000次免费调用。
⚠️ 写得清楚:限非商用。你接进付费产品里,这事儿就不是省钱了,是给自己埋雷。
适合谁:纯研究、非商用、想摸大模型的玩家
10. Cloudflare —— 超量不扣钱
每天1万Neurons,75+个模型。超量不扣钱,只报错。
这种「超了就停、不偷偷扣」的规则,我个人是喜欢的。你至少知道最坏情况是调不通,不是账单跳出来。
适合谁:怕超支、想控制预算的用户
11. NVIDIA NIM —— 模型最多
125个模型全免费,池子里有nemotron-3-ultra 550B、glm-5.2。
限额40 RPM/每天1万次,要手机验证。模型多得有点离谱。
问题是:多不等于你该用。550B拿来回个「今天吃什么」,纯属浪费。
适合谁:想体验超大模型、有明确需求的开发者
12. Cerebras —— 体验金
注册送$5,gpt-oss-120b能免费跑。
当体验卡就行,别指望靠5刀过完一年。
适合谁:想尝鲜、体验不同硬件平台的玩家
免注册4家:临时试手感
这4家连账号都可以先不注册。适合临时验证一个模型,或者半夜突然想试试397B到底什么手感。
不适合:把客户请求直接打上去。
13. OVH
Qwen3.5-397B能直接调。限制很硬:每个IP每分钟2次。
测手感可以,跑批量就别想了。
14. LLM7
匿名10 RPM,领个token能升到40 RPM。比OVH那条活络一点,依然是试用通道。
15. Kilo Code
每小时200次。池子里有nemotron-3-ultra 550B、阶跃step-3.7。
你想碰一下超大模型和国产大杯,这条能过过瘾。
16. OpenRouter
挂着17个免费模型,每天50次。充$10永久解锁每天1000次。

这10刀跟「充一个月官方API」不是一个量级。你要是经常在不同模型之间横跳,它更像一个开关,不是一个钱包。
一张表,对着查

按场景选,别按参数选
做中文日常对话、带工具的Agent → 优先智谱GLM-4.7-Flash
想把Qwen全家桶跑一遍、还是新用户 → 阿里云千问,1亿+tokens先吃掉
做会联网的Agent → 火山方舟那30小时运行时
追速度、试prompt → Groq,每天1000次
塞长文档 → Gemini Flash的1M上下文
写代码 → Mistral新账号那$10,优先砸给Codestral
纯研究、非商用、想摸218B → Cohere每月1000次
连注册都不想 → OVH或LLM7过过手感
这几条别踩
⚠️ 信息截止2026年8月21日。这类福利的半衰期很短,用之前去平台页面核对。
⚠️ 硅基流动的实名,是5月15日就已经开始的事。不是未来时。
⚠️ 火山那30小时和500次搜索,有效期2年。开通了却不用,等于把赠品放过期。
⚠️ Cohere写了非商用就是非商用。别跟产品经理说「先接上,以后再说」。
⚠️ 免注册那4条,IP频率打满被封,别来骂我。那不是额度,是别人的公共入口。
⚠️ 最土的坑:把密钥写进前端、写进演示站、写进发给客户的压缩包。免费额度被刷光,比充钱更窝囊。
我的用法
很土,但实用:
• 日常:智谱+千问卡住基本盘 • 加速:Groq当加速器 • 切换:OpenRouter当模型开关 • 大模型:NVIDIA那种550B,留给真的需要被模型吓一跳的晚上
开通2家日常+1家备用,已经比90%一上来就充钱的人清醒。
你还知道哪家免费额度?评论区补上。
我这张表不保证永远全,只保证今天能让你少点一次充值按钮。
夜雨聆风