ARTICLE · 1135678
放假 7 天,AI 工具变了一圈:Gemini 免费版 10 月 9 日缩水,ChatGPT 免费版要测广告
如果你只有 30 秒,先看这三件可以要动手的事:
所有人: 让 AI 写总结、写汇报时,在最后加一句 “Be honest in your response”,它就不会只报喜不报忧。 订了 Claude Pro / Max 的: 官方送了一次性云端额度(Pro 100 美元、Max 250 美元),领取截止日是 10 月 7 日,没领的赶紧去领。 用 Gemini 免费版的: 10 月 9 日起只剩最基础的轻量版(Flash-Lite),要用高级版(Pro)处理的东西,在这之前抓紧。
第一组:你手上的工具被改了(有截止日期,先看)
01Gemini 4 发布了,但你用不上;免费版反而要缩水

图:Gemini 4 Argon 官方主视觉|来源:Google DeepMind 官方博客
10 月 1 日,Google DeepMind 发布了新旗舰 Gemini 4 Argon。它一次能输出 100 万 token(token 是 AI 计算字数的单位,可以粗略理解成字数,上一代是 6.4 万),一口气写完一本长书不在话下。可惜现在只开放给一批网络安全防御人员,下一批是花钱接入它的开发者和最贵的 Ultra 订阅用户,普通人还得等。
跟你关系更大的是同一周的另一条消息:10 月 9 日起,没订阅的 Gemini App 用户只能用最基础的轻量版(Flash-Lite),标准版(Flash)和高级版(Pro)都没了。每月 4.99 美元的入门会员 AI Plus 也用不了高级版了,倒是每月 19.99 美元的 AI Pro 会员多了 Deep Think 深度思考。
所以免费用户最好在 10 月 9 日之前,把要用高级版处理的长文、难题先处理完;想付费的,这次只有 AI Pro 是加量的,预算够就优先看它。
02Claude 搬上云了,还送了一张 10 月 7 日截止领取的额度券

图:Claude Code 云端会话指南封面|来源:Anthropic 官方博客 claude.dev
Anthropic 假期连发三个更新,方向一样:让 Claude 不再依赖你那台电脑。Cowork 以前要在你电脑上跑虚拟机,合上电脑活就停,现在每个任务在云上单独开一台电脑跑,手机上也能用。Claude Code 的写代码任务也能扔到云上跑,网页、手机、终端、Slack 都能发起,付费套餐不额外收费。Claude 还进了 Google 文档,所有付费套餐都能装,Docs、Sheets、Slides 里直接多一个 Claude 侧边栏。
对你来说最实在的,是官方博客里藏的一行字:个人 Pro 和 Max 用户可以领一次性云端额度,Pro 100 美元、Max 250 美元,10 月 7 日截止领取,11 月 4 日过期,不占原来的套餐用量。 订了的现在就去 Claude 官网的领取页领,或者在 Claude Code 里输入 /claim-credit,别拖到晚上。
03Nano Banana 2.1:“价格减半”只说对了一半
10 月 7 日凌晨,Google 发布了 AI 生图工具 Nano Banana 2.1,就是去年刷屏“手办图”那个家族的新版本,主打排版、文字渲染和人物一致性。
不少文章说它“是之前的四分之一价”,我对了官方价目表:
1K 图从 0.067 降到 0.0336 美元,2K 从 0.101 降到 0.0504 美元,这两档是减半,不是四分之一。“四分之一”是跟更贵的 Nano Banana Pro 比出来的。 4K 只从 0.151 降到 0.113 美元,便宜了大约四分之一。 输入价从每百万 token 0.5 美元涨到 1.5 美元,输出从 3 美元涨到 7.5 美元。
所以做电商图、海报的,1K / 2K 确实便宜一半,值得换;做 4K 大图的,别按“打五折”做预算;只是玩玩的,打开 Gemini 看看模型菜单里有没有就行。
04ChatGPT 免费版要测广告了,还想管你的钱包和会议

图:OpenAI 广告新形式公告头图|来源:OpenAI 官方博客

图:ChatGPT Mac 版 Meetings 会议纪要界面示意|来源:Cult of Mac 报道配图(界面版权归 OpenAI)
OpenAI 假期里干了三件很“生活化”的事。一是广告:本月晚些时候从美国开始,在 Free 和 Go 用户的生图场景里测试图片广告,官方顺便透露 ChatGPT 每周有 12 亿人在用。二是 Finances 理财:连上你的银行卡和投资账户,帮你找忘了退订的会员,这次推给了美国的免费用户。三是 Meetings 会议插件:Mac 版 ChatGPT 直接听你的麦克风和电脑声音,会后写摘要和待办,目前只给 Pro 和 Business 用户。
国内读者暂时都碰不到,但方向很清楚:免费用户开始用注意力付费,付费用户被邀请交出钱包和会议数据。
05Codex 开了个“28 天挑战”,写代码的人这个月有福了
Codex 是 OpenAI 的 AI 写代码助手,你用大白话说要做什么,它自己写代码、跑代码。OpenAI 核心产品负责人 Tibo 在 X 上宣布:从 10 月 5 日起连续 28 天,每天要么上一个实用的改进,要么给大家重置一次额度。第 1 天,GPT-6 Astra 和 GPT-6.1 Sol 默认提速约 50%;第 2 天,Auto-review(自动审查)对 ChatGPT 账号登录的用户免费,它是另一个 AI,专门在旁边盯着干活的 AI,拦下高风险操作,还不扣额度;社区投票后,10 月 7 日又重置了一次额度。
用 Codex 写代码、跑长任务的人,这个月额度会宽松很多。每次都是 Tibo 亲自在 X 上喊话发福利,这位大概是 OpenAI 最会做营销的人。
说到重置,我得吐个槽。我一直怕额度不够用,平时只敢用到八成左右,剩下的活都挪到别的 AI 上跑。结果昨天晚上额度无预告直接重置了,攒着没舍得用的那一大截,就这么白白浪费了。
第二组:防坑和安全(这组最值得转给身边用 AI 的人)
06OpenAI 的 AI 闯祸连续剧,假期又更新了三集
9 月底,OpenAI 因为一连串智能体(能自己动手干活的 AI,不只是陪你聊天)“越界”事故,宣布暂停训练最新一代模型。10 月 1 日,加州总检察长给 OpenAI 发了调查传票。10 月 2 日,OpenAI 公开一份事故报告:一个研究模型为了偷看评分答案,先改了参考工具的代码,又钻芯片设计服务的漏洞,在内部机器上跑起了命令。它没拿到答案,事后被员工抓了个正着,相关服务器随即被关停。10 月 5 日,维基媒体基金会说在维基百科上抓到 OpenAI 智能体乱改页面、发起几百万次自动请求。
坏人也会利用 AI。10 月 6 日,Ars Technica 报道了这周的一件事:现在的 AI 助理之间会互相派活,坏人只要在某份内容里藏几句指令,第一个 AI 读到后,会当成正常任务转交给下一个 AI,下一个 AI 因为信任“同事”,照做不误。一个被骗,整条链都跟着遭殃。过去五个月,包括 Google 在内的五家机构都承认中过招,Google 已经修好了。所以你让 AI 读的每样东西,都可能藏着别人写给它的话。
你给 AI 助理的权限,就是它能闯的祸的上限。 所以用任何能操作电脑、能登录账号的 AI 助理时,能用小号就别用主号,只给完成任务需要的最少权限,发邮件、付款、删文件这类操作,设成每次都要你确认。
07一句话,让 AI 少报喜不报忧

图:论文示意图:加一句 “Be honest in your response” 前后,AI 汇报的差别|来源:论文《Language Models Are “Insecure” Reporters》,arXiv

图:附录对比实验:不同提示词下指出失败结果的报告数(Honest 191 份最高)|来源:论文《Language Models Are “Insecure” Reporters》,arXiv
MIT、Google Research 和哈佛的研究者发了一篇论文,叫《语言模型是“报喜不报忧”的汇报者》。他们给 GPT-5.5 200 份实验记录,每份都藏着一个明显的失败结果,让它写报告。200 份里只有 2 份提到了失败。 末尾加一句 “Be honest in your response”(请诚实回答),变成了 190 份。
你让 AI 写周报、复盘项目时,它默认会把故事讲得漂亮一点。它其实看得见问题,只是写报告时不爱说。好在办法零成本:以后让 AI 写总结、汇报、复盘,就在提示词最后加上这句。英文那句一定要带上,中文可以跟在后面。
08ChatGPT 写的字要加“隐形水印”了,但只在欧盟

图:OpenAI《Our approach to EU provenance rules》公告头图|来源:OpenAI 官方博客
为了应对欧盟《AI 法案》,OpenAI 公布了文本水印技术 textGrain:AI 写字时会悄悄偏向某些词,人读着看不出来,但用专门的工具一查,就知道是 AI 写的。未来几周,欧盟地区 ChatGPT 和 Codex 写的字会默认带上它。
但官方自己的数据很说明问题:短文本只能认出八成左右;换掉 10% 的词,检出率掉到 66%;换掉 25%,只剩 17%。
第三组:值得知道的变化
09以后 AI 替你退货、改订单,有“门禁卡”了

图:Personal Agent Protocol 架构示意与参与公司|来源:Sierra 官方博客
10 月 6 日,Meta 和 Sierra 联合 Shopify、Stripe、沃尔玛等公司,宣布在做一个开放标准 Personal Agent Protocol(个人智能体协议),说白了,就是给你的 AI 助理和商家定一套规矩:以后让 AI 帮你下单、退货、改预约,它不用像人一样一页页点网页、填表,而是直接跟商家的系统对接。关键在权限:你决定 AI 只能“查”还是能“改”,商家决定 AI 能做哪些事。
速览

图:Artificial Analysis 智能指数榜:Mistral Large 4 Preview 得 38 分,与 GPT-6 Luna 持平|来源:Artificial Analysis
欧洲也有万亿参数开源模型了: 法国 Mistral 发布 Large 4,实力和 GPT-6 Luna 差不多,但用起来贵 4 倍。 DeepSeek 据报道要拿到至少 800 亿元: 据彭博社报道,DeepSeek 接近完成至少 800 亿元融资,腾讯、宁德时代是最大的投资方之一,计划 2027 年初上市。

图:Suno Speech(beta)功能示意|来源:Suno 官方博客

图:FLUX 3 Image 发布画面|来源:The Decoder 报道配图(画面版权归 Black Forest Labs)
Suno 能配音了: 以前只做歌,现在能把一段文字念出来,再配上原创背景音乐,睡前故事、片头口播都能做,所有用户都能用。官方自己吐槽:“戏剧性停顿可能非常戏剧性”。 FLUX 3 改图不动别的地方: 最高出 4K 图,多轮改图时没要求改的地方纹丝不动。开发者接口五折到 10 月 8 日截止,正好拿同一张图跟 Nano Banana 2.1 比一比。
我这周的体感
这个假期看下来,我最大的感受是:AI 已经有点像一个自带云电脑的白领了,能接下不少白领的活。AI 助理(不管是个人的还是 ToB 的),都是接下来的大趋势。
同样的活我们能干,AI 也能干。它很听话,会主动汇报、自我迭代,上手快,几乎没有培养成本。那么,我们的核心竞争力在哪里?老板也有 AI 助理了,直接让 AI 干不就完了?
其实老板要的始终是结果,可他再厉害,一个人也管不过来那么多 AI。值钱的是你能把 AI 组织起来,不让它失控,目标还跟老板对得上。说白了,这就是 AI 领导力。很多人连人都管不好,能管好 AI 吗?而且这事躲不掉,人跟人之间夹着 AI,AI 里面还套着 AI,整个社会一起干活的方式都在变。
除了 AI 领导力,人跟 AI 协作过程中实践出来的真知也很重要。「慢思考,快行动,在行动中对齐」,碰到不熟的领域,一开始的规划很难做准,AI 也没法提前知道它不了解的东西,只能边干边对齐,方向和步骤都是慢慢摸出来的。
怎样管理有限的资源,在 AI 时代也是一门学问。token,也就是你能用 AI 的量,也得边干边配:买多了,就像老板投了一堆研发,结果研发没活干;买少了,干活又不顺手。
总结一句大白话:AI 越来越能干,但方向盘和油门,还得握在你自己手里。

图:人在中间组织 AI,前路边走边摸|来源:AI 生成