What's up,大家!这是我的第 93 篇原创文章,也是【AI实盘】系列的第 34 篇。
2026年8月15日AI实战日记,AI 学习有风险,入坑需谨慎。【AI实盘】记录我怎样把 AI 用进真实的学习、开发和内容生产:当天看执行,一周看主线,一个月看趋势。本文仅用于记录我个人的 AI 学习与实践,最多可作参考,不对任何人构成 AI 学习建议。
概览
这一天没再写一长串流水账,反而把取证方法逼清楚了。重心从记录多少,转到对话里反复追问的点、图表里最耗的任务、项目归并后的真实落点,以及最后能不能拿出回读得动的结果。
少记录时的取证口径也被拉直了。空白不再被当作无重点,重点回到用户追问、作者列表、报告返工和能读回来的产物。当天待发布稿、任务图和作者列表索引都能回读;但作者列表和看板仍没有到可验收收口,所以这期只能算把边界收紧,还不能算主线交卷。
模型分析

| 分析项 | 数据 | 分析 |
| 使用总览 | 4,481 请求;674.25M Token;27.1h 模型 | 投入升高 |
| 模型分布 | gpt-5.5 426.10M;gpt-5.6-sol 247.59M;其他 560.86K | 5.5 主力 |
| Token 使用趋势 | 输入 96.59M;输出 3.31M;缓存读 574.35M | 缓存占 85.2% |
和近三天基线比,请求数、Token 和模型小时都上来了;和前一日单日比,Token 上升,模型活动覆盖和模型小时反而收短。这更像高上下文、高返工、高并行被压进更密的工作窗口,工作时间没有随之自然拉长。gpt-5.5 仍是主力,gpt-5.6-sol 负责补位;模型用量只能说明投入强度,最后仍要回到会话、项目和产物上验。
生产力分析


| 分析对象 | 生产/工作时间 | 无生产/休息时间 | 分析 |
| AI 生产分析 | 模型活动覆盖 17.5 小时;单日稿本日值就是日均口径 | AI 空窗 6.5 小时;只表示模型无活动,不推断本人休息 | 高密度执行,集中在图表、作者列表、报告收口和治理纠偏 |
| 本人工作分析 | 130 条直接输入;人工介入覆盖 11.75 小时;单日稿本日值就是日均口径 | 当天生活证据不足,不补私人作息 | 以发起、评审、纠偏和验收为主 |
| AI 与人 | 人机同步 10.75 小时;AI 独立 6.75 小时;单日稿本日值就是日均口径 | 关系不明 6.25 小时 | 有杠杆,也有返工;不能只看覆盖时长 |
当天人工输入分散在发起、评审、纠偏和验收之间,涉及会话决策、图表口径、模板、脚本和自动化纠偏。直接输入只代表这些 15 分钟窗口出现过人工介入,不能换算成连续工时;地点、通勤和具体生活安排缺少当天确认,所以保留证据边界。
AI 侧活动覆盖接近整天的七成,真正有价值的部分来自图表更新、任务归并、待发布稿和若干规则收敛。45 次返工说明杠杆没有白来,也没有免费来;人机协同当天更像一边推进,一边把错误口径往回拧。
消费分析

| 消费范围 | 当日消费与规模 | 近期趋势 | 分析 |
| 全部模型与渠道 | ¥40.00;4,481 请求;674.25M Token | 较前一日金额 +34% | 实付强度下降 |
本期人民币实付和同周期 Token 都可信,实付倍率按 40.00 / (674.25M / 1,000,000) ≈ 0.059 元/百万 Token 计算。这个数字要和美元标准价分开看;它说明单位 Token 的人民币实付强度略低于前一日的约 0.063,但总支出仍上升。
投入变重的原因,主要还是长上下文、并行执行和返工叠在一起。这笔投入主要落在统计、列表、报告和治理这些可回读对象上;作者列表和看板验收仍没有完全交卷。
进展

| 项目 | 当天做了什么 | 最终结果 |
| multiplatform_extractor | 公众号作者列表链路占到项目归并第一,WeChat 作者索引、平台索引和当天本地 / 在线文章文件已经刷新 | 有可回读索引,仍缺作者、篇数、失败项的单列验收 |
| report-dashboard | 在记录变少的情况下,把手工稿、任务图、发布边界和 8月13日日报交付审计合成一条证据链 | 本篇待发布稿完成,上期超时已入账,仍需压低报告链自耗 |
| sharingan_ai_usage | 全日统计、任务 / Session 双栏图、Ryan 工作图和消费口径支撑了本篇判断 | 图表可复核;作为证据支撑,不单独算项目交付 |
| skills-kanban | 看板与任务纠偏消耗靠前,暴露技能治理仍在占用注意力 | 有纠偏线索,缺页面或状态验收 |
| codex-scheduler | 标题、时间和调度口径继续被纠偏,暴露自动化治理成本 | 规则边界更清,缺运行级闭环 |
这张图不能只看排名,也不能把排名靠前的对象删掉不讲。任务 Top 里,2026080611_wechat-daily-collector 吃掉 141.35M Token,落到作者列表链路;2026081400_daily-report 和 20260806_ai_usage 紧跟其后,说明报告与用量口径本身也在烧上下文。skills-kanban 和 codex-scheduler 不是没有发生,而是证据边界不同:它们有纠偏和规则收敛,缺页面、配置或状态回读,不能写成已经交付。
项目归并后,作者列表仍是当天最大的业务入口;报告链把手工稿、任务图、发布边界和上期交付审计收成一条线;用量统计提供了判断依据。能确认的结果入表,没验出来的成果写清限制,再接到问题和计划里。
问题
| 问题 | 影响 | 解决过程 | 当前结果 |
| 记录变稀后的取证容易失真 | 空白容易被误写成无重点 | 改为先看用户追问、高耗会话、项目归并和真实产物 | 口径已改,仍需每期执行 |
| 作者列表未验收 | 最大项目入口还不能算交付 | 已看到 WeChat 作者索引、平台索引和本地 / 在线文件刷新,但缺少作者、篇数、失败项清单 | 部分完成,待闭环 |
| 上期日报交付太晚 | 次日凌晨任务拖到下午和傍晚 | 拆分计划、启动、成稿、回写 | 超时成立 |
| 报告链自耗偏高 | daily-report 自身排到第二 | 先收住手工稿和待发布边界 | 待降载 |
| 看板和调度治理缺验收 | 规则纠偏容易被误写成项目进展 | 已确认纠偏线索,但还没有页面、数据或状态结果证明交付 | 未闭环 |
| 项目归属易跑偏 | 高耗名称容易盖过真实结果 | 用项目登记、产物和发布记录校准 | 继续盯住 |
| 上期纠偏没有完全转成正文检查 | 标题、作息、主线、输出完整性等问题容易在本期复发 | 重新核对上一批对话问题,把能公开的要求分流进生产力分析、进展、问题、计划和最后 | 已补进成果文档;完整问题清单留在完成回复 |
记录少以后,最容易把高耗会话写成主线,把目录名称写成成果。这一次要反过来处理,先把高耗会话当取证入口,再用项目登记、真实产物、测试结果和发布记录交叉验证。这样可避免把报告链、统计口径和备份索引写成项目胜利,也保留作者列表和看板纠偏。
8月13日日报的时间审计也必须算问题。计划触发在 2026-08-14 00:30,workflow 到 04:12 才有启动证据,16:25 才 finalize,18:28 才完成草稿箱或 Dashboard 回写。它说明报告链没有在凌晨形成可读交付,挤占了当天的项目窗口。这个问题不能藏在后台,只能放到问题栏里承认。
计划
| 明日计划 | 执行动作 | 完成标准 |
| 验收作者列表链路 | 列出当天作者、篇数、失败项和可继续状态 | 有可回读清单 |
| 降低报告链自耗 | 先写可读稿,再补证据、审核和归档 | 正文、证据和归档均可回读,收口不挤占主线窗口 |
| 固定少记录口径 | 每期先看用户追问、高耗任务、项目结果和真实产物 | 文章能回答当天在做什么、为何耗时、有没有结果 |
| 验收看板和调度治理 | 各拿一个页面、配置或状态回读结果 | 关键入口和状态能够直接读回 |
| 约束项目归属 | 把作者列表、报告链和看板治理的结果边界分开 | 不把工具日志写成项目成果 |
| 固定上期问题回写 | 生成前把上一批问题核实逐项映射到标题、作息、进展、问题、计划和最后 | 不再只把详表留在完成回复 |
明天先处理能验收的东西。作者列表要从接续推进变成一张能读回来的清单;看板和调度治理也要各自拿一个页面、状态或配置结果。报告链继续做交付门槛,但不能把自己当主线。先把正文写成人能读的稿,再补证据、审核和归档,别把整天烧在收口上。
最后
这天记录少,账不能糊。人把问题挑出来,AI 把证据翻了一遭。
作者列表往前露头,报告链也跟着烧油;稿子能交,看板和清单还没验透。
下一回先点作者,再验看板调度。能落地的当场落地,没闭环的别再冒充收成。
夜雨聆风