不知不觉,2026年已经过半。作为一个纯AI新手,这半年我硬生生把自己从“只会问 DeepSeek 问题”的小白,逼成了“熬穿无数通宵、烧掉近 10 亿 Token、折腾 N 种工具”的野生极客。过程谈不上优雅,但足够真实——谨以此文,记录这段痛并快乐着的折腾史。

一、起因:怎么开始折腾的
一开始只是拿 DeepSeek 问点问题。后来某天看到有人用 AI 做视频,纯图加文字、配个 BGM 那种,我也想试。DeepSeek 负责脚本,豆包负责出图,最后剪映一拼,三下五除二就出了一个像模像样的视频。
再后来,豆包成了我公众号文案的常驻写手。再后来,我开始听说一个叫 OpenClaw 的东西——一个号称"本地一键跑 AI"的小工具,当时的口号是"装上就能在自家电脑上跑出大模型"。
光是为把它部署起来,就花了近亿 Token,反反复复打磨它的 skill。skill 是啥?说白了就是给 AI 写好的"说明书 + 操作包",让它知道遇到这个场景该调哪个工具、怎么调。

那个阶段我没意识到,我已经在玩一种新东西了——从"用 AI"变成了"造 AI 工具"。
再往后接触到 ClaudeCode(编程类 Agent,写代码对话两不误)、Hermes(另一个 AI 编程工具,据说能力很强)、VS Code(微软的代码编辑器,写程序的都知道),最后用得最多的反而是 Codex——OpenAI 出品的代码助手,关键时刻靠得住。

二、折腾:那些崩溃的晚上
最开始做工作流,用的是 N8N —— 一个可视化拖拽的流程编排工具——加上本地部署 Ollama。Ollama 是啥?一个让你能在自家电脑上跑大模型的软件,相当于"本地 AI 的启动器"。
我信心满满以为能跑通,结果虽然只有一个环节跑通了,但整条流水线基本算失败 。
后来改用 ClaudeCode 做工作流。N8N 是拖积木,ClaudeCode 是直接写代码。复杂程度一下子上来十倍不止。偶然碰到 VS Code——不是用 VS Code 写代码,是用 VS Code 当"指挥部",把所有 Agent 通过配置文件接起来。

于是开启了一场旷日持久的拉锯战。在 ClaudeCode、VS Code、Hermes 几个 Agent 之间反复循环修复——一个挂了切另一个,另一个挂了再切回来——到最后是 Codex 把这条快坠毁的工作流救回来的。
就在几乎无限接近跑通的时候——就剩封面图了——我记得是 6 月 9 日去市区买显卡和固态硬盘。回来又开始重装系统反复折腾,光是重装 Win11 就差点把我整崩溃。
原因说出来好笑:我这台 2016 年配的电脑,华硕 B150 主板、i5-6500 处理器,没有 TPM2.0——这是 Win11 强制要求的安全模块——老电脑压根不支持。开强制安装模式,装到一半崩三次。

总算弄好了。重装 ClaudeCode,又是曲折不断。本来都打算放弃 ClaudeCode、改用 Hermes——结果 Hermes 给机会也不中用。期间也试过回 OpenClaw,一如既往"更新完就坏掉",于是彻底放弃。
研究来研究去,硬着头皮又回到 ClaudeCode。
截止发稿:总花费近 10 亿 Token,工作流还没完全跑通。
幸好:全是免费的。

三、薅羊毛:用 AI 的真正姿势
从一开始部署 OpenClaw 在各种平台薅零星免费 Token,到后来一直薅 NVIDIA (NVIDIA:你也别可着我一个人薅),这是 NVIDIA 提供的免费 AI 推理接口,额度大、速度快,薅到我甚至有点心虚。
再到觉得最好用的是 Agnes,我用的主要是两样:
- Agnes-2.0-Flash——文本模型,上下文能拉到 100 万 token,写代码、写文案、写脚本都顶用。
- Agnes-Image-2.1-flash——图像模型,最高能出 4K 分辨率。API 直接能用,但要嵌进我这套工作流,得先做一层 skill 封装——把 Codex 当胶水接到流程里。
后期的重点是把 Agnes-Video-2.0 做成视频生成 skill——这个模型说是能生成"音画同步、电影级质感"的视频,等于开了个外挂机的口子。

四、共鸣:钓鱼佬、熬夜党、和永远卡 99% 的工作流
使用 Agent 的过程和成为钓鱼佬的过程差不多:
钓鱼——渔具买得越来越多,鱼钓得越来越少。
用 Agent——skill 安装得越来越多,实际用到的越来越少。
AI 好不好用,自己用了才知道。这是我熬了不知道多少个通宵才总结出来的经验。

像我这台 2016 年配的电脑——华硕 B150 主板 + i5-6500 + RTX3060 12G——能 Ollama 本地部署 Gemma 4 12B(一款谷歌的小模型),也能 llama.cpp 本地部署 Qwen3.6-35B-A3B——阿里通义千问出的 MoE(混合专家)架构,总参 350 亿、推理时只激活 30 亿,这台老机子跑出 19 token/秒——这命名也是够个性。


写在最后
半年下来,我最大的体会不是"学会了什么",而是"敢浪费什么"。
敢浪费 Token——反正免费。
敢浪费通宵——反正第二天没课。
敢浪费一次机会—— Hermes 不行就换 OpenClaw,OpenClaw 坏了就换 ClaudeCode,ClaudeCode 卡了还有 Codex。
AI 时代最大的奢侈,不是 GPU、不是会员,是你敢试错的次数。
如果你也在熬夜熬到第 N 个通宵——欢迎留言,咱们通宵党,从来不是一个人。
下个半年,计划把工作流最后 1% 收尾,做一个能跑通的、能复用的、能给别人用的版本。具体怎么做,还在摸索。到时再写一篇总结给大伙。
—— 一个 AI 纯新手小白的年中总结,写于 2026 年 6 月 23 日。
夜雨聆风