
本文目录
01 先看一个反差:同样是 Agent 报告,为什么像在讲两个世界?
02 六个维度看Claude vs Codex用户使用差异
03 Claude -节律(Cadences):AI 先变成了人的日常节律
04 Claude -产物(Artifacts):它产出的是一批可识别的产物
05 Claude Code:同一个 Claude,到了代码界面,自主度立刻变高
06 Claude -感知(Perceptions):问用户,你怕不怕?
07 Codex 报告:AI 不再只是聊天,而是在被派活
08 谁在用 Codex?开发者仍是主体,但边界正在往外扩
09 Codex 被用来做什么?不只是写新代码
10 Codex 的关键变化:任务开始变大
11 Codex 的重度用户,已经在管理一队智能体
12 低摩擦环境里的未来样子(OpenAI内部):产出 token 爆炸
13 放在一起看
关键词:AI Agent、Claude、Codex、Anthropic Economic Index、OpenAI Codex Report、智能体 AI、AI 用户画像、AI 使用场景、AI 工作流、劳动增强、任务委派、Agent 经济、AI 编程、知识工作自动化
01|先看一个反差:同样是 Agent 报告,为什么像在讲两个世界?
这两天,Anthropic 和 OpenAI 都更新了各自关于 Agent 用户画像和使用场景的报告。
Claude 这篇是 Anthropic Economic Index 团队发布的《Economic Index report: Cadences》,看的是 Claude 生态里的 Chat + Cowork、Claude Code 一方 API,并在部分章节把 Chat/Cowork、Claude Code、1P API 和约 9700 份隐私关联调查分开呈现。
详情:https://www.anthropic.com/research/economic-index-june-2026-report
Codex 这篇是 OpenAI 与哥大、沃顿、杜克等商学院学者发布的论文《The Shift to Agentic AI: Evidence from Codex》,看的核心对象是 OpenAI 的 Codex 智能体工作平台,并把 Codex 与 ChatGPT 使用日志做对照;样本分为个人用户、企业用户和 OpenAI 内部员工,很多关键指标用的是 Codex 在 Codex + ChatGPT 合计产出 token 中的占比,以及任务复杂度、并发、运行时长、skills 调用等工作流指标。
但读完之后,你会发现它们给出的画面几乎相反。
在 Claude 的报告里,AI 像水一样渗进日常生活:工作日写邮件、做 PPT,周末聊情绪、问医疗、做投资建议;早上 7 点看新闻,下午 6 点问食谱,凌晨 5 点问睡眠。它更像一个贴着人类作息走的助手。
到了 Codex 的报告里,AI 则变成了一个可以被派活的系统:用户把调试、重构、配置、写文档、数据分析交出去;重度用户同时管理多个智能体;有的任务跑数小时,甚至一天累计跑出几十小时的 Agent 工作量。它更像一组被人指挥的数字工作者。
这个反差,才是这三篇文章最值得读的地方。

图 1|对比分析:从交互界面到头条叙事,Claude 与 Codex 的两条链路。
我的理解是:两份报告测的根本不是同一种“工作原子”。
Claude 报告的原子,是一次对话或一次 Claude 生态内的使用切片。对话有时间戳、有来回、有产物,也能和用户调查关联。所以它自然会讲节律、产物、感知,以及“AI 是不是让人更焦虑”。
Codex 报告的原子,是一个被委派出去的 Codex 任务。任务有运行时长、有 token、有并发、有技能调用,也能和组织职位、资历、工作流联系起来。所以它自然会讲谁在派活、派什么活、怎么并发、产出怎么爆发。
一句话说:Claude 更像在看 AI 怎么进入社会;Codex 更像在看 AI 怎么进入生产系统。
02|六个维度看Claude vs Codex用户使用差异
两家公司选择把不同的镜头推到台前:Anthropic 当然也有 Claude Code,而且报告里明确提到 Claude Code 的 AI 自主度更高;OpenAI 当然也有 ChatGPT。差别在于,谁被放在头条,谁被放进脚注。
03|Claude -节律(Cadences):AI 先变成了人的日常节律
Claude 报告最有意思的地方,是它不像一份纯技术报告,更像一份“AI 如何嵌入社会生活”的观察笔记。
先看时间。
工作日,Claude 更常被用来处理商务函件、营销文案、PPT。到了周末,被归类为个人用途的对话,从工作日约 35% 上升到接近 50%。周末涌进来的需求,是情绪支持、医疗问题、投资建议、创意写作。

图 2|Claude 报告图表:周末个人用途占比明显上升,工作日和周末呈现不同使用节律。
再看一天里的节奏。
早上 7 点,新闻请求走高;上午 10 点到 11 点,商务邮件起草有小高峰;下午 6 点,食谱请求达到平均值的 2.3 倍;晚上开始问影视推荐;凌晨 5 点前后,睡眠建议达到峰值。
这很像一张人类生活的心电图。AI 没有悬浮在工作之外,而是嵌在具体的饭点、睡前、通勤、deadline 里。

图 3|Claude 报告图表:不同请求在一天中有清晰峰值,AI 使用贴着生活场景起伏。
还有一个很生动的外部事件:美国报税截止日。
4 月 14 日,税务相关对话的出现频率是 5 月平均水平的 8 倍。4 月 16 日又快速回落。美国以外地区没有对应峰值。
这说明 Claude 的使用,不只是“用户无聊时打开 AI”,而是在真实社会事件里被调用。

图 4|Claude 报告图表:美国报税日前后税务相关请求激增,外部日历事件直接改变 AI 使用。
04|Claude -产物(Artifacts):它产出的是一批可识别的产物
第二个值得注意的点,是 Anthropic 不只看用户问了什么,还看 Claude 最后产出了什么。
报告把产物分成 30 多类,发现 93% 的对话都能识别出主要产物。最常见的不是代码,而是解释、文档/报告、指导建议。
具体数字是:解释 17%,文档与报告 15%,指导建议 11%;代码和技术工作约占 1/6。

图 5|Claude 报告图表:93% 的对话可识别出产物,解释、文档/报告、指导建议排在前列。
这个发现很重要。它提醒我们,AI 的主要价值可能不是“回答问题”,而是把一个模糊需求变成某种可交付物:一段解释、一份报告、一个方案、一封邮件、一段代码、一个规划。
也因此,Anthropic 接着看了一件更接近经济学的问题:不同价值的工作,会消耗多少计算?
结论很直接:映射到高薪职业的对话,消耗更多 token。营销经理相关任务的 token 消耗,约为编辑相关任务的 2.5 倍;构建 App 的对话超过中位数 3 倍,解释类对话只有中位数约 1/5。

图 6|Claude 报告图表:计算消耗与映射职业薪资呈正相关,高价值任务通常需要更多 token。
但这里最耐人寻味的,不是“高薪任务更贵”,而是“人没有消失”。
高薪职业相关对话,总 token 消耗是低薪职业相关对话的 2.07 倍;Claude 每轮输出更长,但用户参与轮次也更多,是 1.53 倍。
换句话说,价值越高,人越不是退出现场,而是更深地在场。

图 7|Claude 报告图表:高薪任务里 Claude 输出更多,人类参与轮次也更多,呈现劳动增强而非简单替代。
05|Claude Code:同一个 Claude,到了代码界面,自主度立刻变高
这也是对比分析里最微妙的一点。
Anthropic 虽然把整份报告写成“经济与社会节律”,但它没有回避 Claude Code 的差异。报告明确说,Claude Code 上几乎所有产物类型的 AI 自主权都高于 Chat/Cowork。
平均差距是 0.37 分,量表是 1 到 5。更重要的是,其中约 2/3 的差异来自同类任务被更多地委托给 AI,而不是任务本身变了。
比如写博客,在 Chat 里中位数是 13 轮对话;到了 Claude Code,中位数可以变成 1 轮人类干预。

图 8|Claude 报告图表:Claude Code 在多数产物类型上表现出更高 AI 自主度。
所以,所谓 Agent 的差异,不只来自模型能力,也来自产品界面。
同一个用户,同一个底层模型,如果被放进聊天窗口,他更容易反复追问、共同打磨;如果被放进代码环境,他更容易把一个完整任务交出去,让系统自己跑。
06|Claude -感知(Perceptions):问用户,你怕不怕?
Anthropic 报告还有一部分很值得看:它把用户调查和实际使用数据关联起来。
近 9700 名受访者被问到:AI 今天能独立完成你多少比例的工作?12 个月后呢?
结果是,近 60% 的人认为未来一年 AI 能完成的工作份额会上升;超过 1/3 的人预期 AI 明年能完成自己“大部分或几乎全部”工作任务。

图 9|Claude 调查图表:多数用户预期未来一年 AI 能完成更大比例的工作。
照理说,越把任务委托给 AI 的人,应该越焦虑。
但数据呈现了相反结果:在薪酬、职业安全、求职能力、意义感、自主性、人际互动六个维度上,自动化份额越高的用户,对 AI 的影响感受越正面。
这不是说风险不存在,而是说明一个很重要的心理机制:真正高频使用的人,看到的不只是替代,也看到可掌控的收益。

图 10|Claude 调查图表:自动化份额更高的用户,在多个维度上反而更乐观。
最后一个开放问题也很有意思。用户十年后希望看到的 AI 经济,不是“AI 彻底替代人”,而是三个愿望排在前面:人机协作,保留有意义工作;自动化枯燥事务,释放自由时间;AI 红利被更广泛共享。

图 11|Claude 调查图表:用户对十年后 AI 经济的期待,集中在人机协作、释放时间与共享红利。
07|Codex 报告:AI 不再只是聊天,而是在被派活
如果说 Claude 报告像一张生活节律图,那么 Codex 报告更像一张工厂改造图。
它的核心问题不是“用户什么时候问 AI”,而是:用户把什么任务委派给 AI?这些任务有多复杂?AI 跑了多久?用户有没有开始并发管理一队智能体?
先看采纳。
截至 2026 年 6 月 11 日,按 Codex 在 Codex + ChatGPT 合计产出 token 中的占比看,OpenAI 内部达到 99.8%,企业用户为 63.3%,个人用户为 16.5%。
但如果看“用过 Codex 的活跃用户占比”,个人用户不足 1%。
这两个数字合在一起,说明一个很关键的事实:Codex 的广度还低,但一旦采纳,强度极高。

图 12|Codex 报告图表:三类用户的采纳广度与使用强度差异巨大。
这也解释了为什么普通人对 Codex 的体感,可能和 OpenAI 内部完全不是一回事。
在外部,它还是少数高强度用户的工具;在 OpenAI 内部,它已经几乎变成默认工作界面。
08|谁在用 Codex?开发者仍是主体,但边界正在往外扩
Codex 当然首先是开发者工具。个人和企业账户里,全栈工程师是占比最高的单一画像。
但报告强调,增长不再局限于开发者。OpenAI 内部的用法尤其明显:Codex 开始进入研究、沟通、招聘、销售、数据分析等工作。

图 13|Codex 报告图表:用户画像增长不再局限于开发者,通用知识工作者和个人用途也在上升。
按职能看,工程和技术岗领先并不意外。企业侧,工程/技术从业者 Codex 占比为 26.8%,数据与分析约 15.2%,法务平均只有 1.9%。
但报告提醒,不要被平均值骗了。
在真正采纳 Codex 的工程师里,他们贡献了这类岗位 88.3% 的总产出 token;法务岗平均很低,但采纳者贡献了法务总产出的 17.6%。也就是说,工具一旦被某些人纳入工作流,使用强度会迅速拉开。

图 14|Codex 报告图表:按职能看,技术岗领先,但非技术岗采纳者也贡献了不低的产出。
09|Codex 被用来做什么?不只是写新代码
Codex 报告很重要的一点,是把“软件生产”拆得更细。
用户不是只让它生成新代码,还让它做工程运维、代码理解、应用管理、代码校验、环境配置、文档、Bug 修复、仓库管理、浏览器操作、规划。
这说明 Agent 的价值,不只是“帮我写一段函数”,而是嵌入整个软件开发生命周期。

图 15|Codex 报告图表:一级任务构成显示 Codex 以软件生产为锚,但覆盖工程运维、代码理解、应用管理等多个环节。
再往下看二级任务,会更像真实工作现场:环境配置、Codex 配置、文档、代码问答、仓库管理、浏览器操作、规划、Bug 修复。
这些不是漂亮 demo,都是软件团队每天要处理的琐碎连接处。

图 16|Codex 报告图表:二级任务显示 Codex 已进入文档、配置、仓库、浏览器操作、Bug 修复等周边流程。
10|Codex 的关键变化:任务开始变大
真正体现“Agent 化”的,是任务复杂度。
报告用分类器估算:如果没有 AI,资深人类完成某个任务需要多久。
2025 年 12 月,只有 35.4% 的活跃个人用户至少发过一个“需要资深人类 1 小时以上”的任务;到 2026 年 5 月,这个比例上升到 70.2%。
更夸张的是 8 小时阈值:至少发过一个“需要资深人类 8 小时”的任务的用户,占比从 2.1% 升到 25.6%,接近 10 倍。

图 17|Codex 报告图表:复杂任务发起占比快速上升,8 小时级任务用户占比接近 10 倍增长。
这里的变化,不是用户问得更勤,而是用户敢把更大的活扔给系统。
并且报告发现,最难的任务往往出现在一个线程的第 1 回合。用户先把最大块的任务抛出去,后面再做窄范围修正。
这就是“委派”的姿势:先给目标,再验收和收束。
11|Codex 的重度用户,已经在管理一队智能体
Codex 报告用三个指标描绘工作流重组:并发、长时运行、系统化。
先看并发。
企业用户 67.4%、个人用户 63.9% 在观察周里完全没有并发;即便有并发,多数峰值也只有 2。
但 OpenAI 用户很不一样:只有 10.7% 任一时刻只跑单一工作流,近 28.6% 在一周内某个时刻同时管理 5 个以上智能体。

图 18|Codex 报告图表:OpenAI 内部用户的并发 Agent 管理明显高于企业和个人用户。
再看长时运行。
OpenAI 中位员工在 2026 年 6 月 11 日当天,有 2.5 小时 Codex 回合在跑。更极端的是尾部:OpenAI 99 分位用户近期平均一天累计跑约 71 小时智能体回合。因为有并发,单日累计可以超过 24 小时。
这不是说要一个人连续坐在电脑前 71 小时,而是,一个人在让多个 Agent 同时干活。

图 19|Codex 报告图表:Codex 回合累计运行时长显示,尾部用户已经出现多 Agent 长时并发工作。
最后看系统化,也就是 skills。
一次性使用是“帮我做这件事”;系统化使用是“把我反复要做的流程固化成可复用例程”。
截至 2026 年 6 月 11 日前 7 天,个人活跃用户 25.7%、企业用户 30.4%、OpenAI 内部用户 96.2% 调用过至少一个技能。整体周活用户中,调用任意技能的比例从 3 月 1 日的 5.4% 升到 6 月 11 日的 26.6%。

图 20|Codex 报告图表:技能调用率快速增长,组织环境中自定义与插件技能更容易沉淀为工作流基础设施。
这可能是 Codex 报告里最接近“组织变革”的信号。
当一个团队开始写自己的 skills,它就不只是用一个工具,而是在把团队规范、流程偏好、周期性任务、上下文知识编码进 Agent 系统。
12|低摩擦环境里的未来样子(OpenAI内部):产出 token 爆炸
OpenAI 内部不代表一般企业。
这一点报告也反复提醒:OpenAI 内部是低摩擦极端环境,用量不限、经验共享多、工作贴近系统,不能直接外推。
但它可以提供一个“如果摩擦极低,会发生什么”的样本。
图 12 显示,从 2025 年 11 月 1 日到 2026 年 6 月 11 日,OpenAI 各职能中位员工的合计产出 token 至少增长 10 倍;研究岗 56 倍,客服 32 倍,工程 27 倍,法务 13 倍。

图 21|Codex 报告图表:OpenAI 内部各职能中位员工产出 token 在低摩擦环境下显著增长。
这张图不该被简单理解成“生产力提高 56 倍”。token 不是产值。
但它说明,当工作界面从聊天变成智能体,当组织允许人更自由地派活、并发、复用流程,产出文本和代码的吞吐会发生数量级变化。
下一步真正重要的问题,是这些 token 中有多少变成了可用产物,又有多少需要人类返工、审核、整合。
这部分,可参考最近的发布的另一篇报告:AI 需求侧到底有多少真实收入?2026年AI经济状况解读
13|放在一起看
读这两篇报告,我们正在看到 AI Agent 的两个方向同时成形。
一个方向是 Claude 代表的广度:AI 进入工作日、周末、饭点、睡前、报税日,进入解释、文档、指导、代码、情绪支持、医疗建议、投资建议。它让我们看到 AI 如何变成社会生活的基础层。
另一个方向是 Codex 代表的深度:AI 进入软件生产和组织工作流,任务变大,运行变长,多个 Agent 并发,技能把一次性交互变成可复用流程。它让我们看到 AI 如何从“回答问题”变成“承担任务”。
如果你是产品、运营、数据或经营分析岗,我会把两份报告这样用:
1想看大盘人群的采纳、使用场景、情绪和社会接受度,看 Claude 框架。
2想看自动化前沿、工作流重构、组织内效率变化,看 Codex 框架。
3读任何 AI 使用报告,先问三个问题:它的原子单位是什么?谁被采样了?发布方想让你相信什么?
最后,最值得警惕的也在这里。
Claude 报告会让人觉得 AI 很温和:它跟着人类节奏走,帮人写文档、做解释、提建议,重度用户反而更乐观。
Codex 报告会让人觉得 AI 很激进:它开始被派去做 8 小时级任务,开始并发,开始长跑,开始把团队流程固化进 skills。
两者都是真的。它们只是站在不同入口看同一件事。
AI Agent 不是突然替代所有人,也不是永远只是一个聊天助手。它更可能先变成两种东西:一边是贴身的日常协作者,一边是可调度的任务执行系统。
而真正会发生变化的,是夹在中间的人:他不再只是提问者,也不完全是被替代者。他会越来越像一个会写 brief、会拆任务、会开并行线程、会验收产物的人。
本文基于 Anthropic Economic Index、OpenAI Codex 使用证据报告整理。

关于我们
探微观智聚焦AI产品和创作,思考下一代AI原生产品和交互灵感。从ToC产品创新,到模型、平台、生态、资本、观点报告等上下游迭代趋势,以一线产品实战视角切入,拆解可复用的“AI产品灵感基础模块”,每日更新。

联系我们:进入探微观智公众号,选择“企业合作”。
☯️从罗振宇到冯友兰:AI时代人类生存指南 ☯️李继刚:人与AI的关系—写日记可能是人在AI时代最无悔的事情 👨Manus的 AI 产品心法:从“品味”到“护城河”、从“取舍”到“增长”的深度解读 ☁️A16Z Big Ideas 2026:关于2026年科技趋势的47条“剧透”,AI 走出屏幕,物理世界可“编程”
🐒给打工人:AI赋能人工,从入门到精通.pdf 🐒给老板:AI替代人工,从入门到精通.pdf ✍️AI-native组织协作指南.pdf 💰AI公司的商业化难题:别再用 ToC 和 ToB 给 AI 公司贴标签了 🤖为什么 Anthropic 能做出大厂做不出来的模型和 Agent? 🦞龙虾系列08|我把 Karpathy 的"个人知识库"工作流做成了一键可用的工具 🦞龙虾系列07|Anthropic 在命令行里养了 18 只宠物:Claude Code “Buddy”宠物系统对于“效率×陪伴”产品的四个启示 🦞龙虾系列06|拆解Claude code源代码,发现好的Agent架构和好的公司管理,底层逻辑是相通的 🦞龙虾系列05|我用7个Agent模拟了一场“艺术与科技跨界孵化”的讨论:AI时代,最适合诞生下一个“达芬奇” 🦞龙虾系列04|OpenClaw 和它的四个"挑战者"都在做什么 🦞龙虾系列03|解剖Agent,发现其实没有“魔法”,Agent = 模型 + Harness 🦞龙虾系列02|关于 OpenClaw 帮你赚钱的机会:A2A 生态起来后,钱会流向哪里 🦞龙虾系列01|OpenClaw 与 AI Agent 时代:当 How 被自动化,人还剩下什么? 👾Web 4.0:当 AI 不再需要人类“批准”时,会发生什么?软件的用户不再是人类,AI直接帮你赚钱 ❤️🔥ELYS 深度测评:当社交圈里住进了硅基生命,价值其实不在社交本身(含50个独家邀请码) 🪄一手测评AnyGen:字节版NoteBookLM + Manus,幻觉少、不废话!把“麦肯锡能力”开放给每个人,还能做漫画和3D粒子魔法特效
🙋AI周报|AI开始进实验室、超级App和支付账户(6.14-6.20) 🙋AI周报|Fable 5四日下线,Kimi开卡,微信Skill和Apple Siri作系统入口 🙋AI周报 | 微软Project Solara争当“一核多端”跨设备OS,李飞飞重立世界模型分类法 🙋AI周报 | 支付宝基建 Agent 经营路,Opus 四点八产品化组合拳 🙋AI周报 |OpenAI 五千亿筹备上市 Google 三协议铺路通商 🙋AI周报 | Agent 掌柜入了账房、模型破了回合制 🙋AI周报|Codex 升堂夺嫡争通用,外壳封装另起炉灶新 (Harness-as-a-Service) 🙋AI周报 五一合集|AI 商业化拐点到来:豆包付费、但 AI 订阅经济学失衡
夜雨聆风