⚓ 今日主线
今天 26 条里,只有 3 件事值得记:
1. Anthropic 同日双发:Sonnet 5 + Claude Science,把战场拉到科研工作流
Sonnet 5 把价格打到 input $2/百万(限时至 8.31)的同时把编程和工具调用能力推到接近 Opus 4.8,意味着 Claude 第一次在工程场景里同时具备'够用 + 便宜'两个条件。对你而言:如果你之前在 Claude Code 上还犹豫过 token 成本,今天起可以无脑用 Sonnet 5 跑日常任务,留 Opus 4.8 留给真正复杂的架构设计。Claude Science 同步上线,把 AI 从'能读论文'推到'能跑实验'——60+ 预置 skill、BioNeMo 接入 Evo 2/Boltz-2、本地/HPC 双模式,这才是 Anthropic 想锁定的下一波增长曲线:科研人员这一群高价值付费用户。
2. 中国监管侧利好:商务部解除 Claude Fable 5 / Mythos 5 出口管制
这条对国内用户是真实的'能用上'信号。Anthropic 官方声明'明天开始恢复访问',意味着被卡了一段时间的 Claude 高端能力要重新在国内可见。给你老板的两条具体建议:(1) 立刻准备一套 Sonnet 5 接入备份,之前因断供迁移到 GPT/Gemini 的工作流要做双轨兜底;(2) 关注 Mythos 5(Fable 5 是大小写变体,官方公告用了 Fable 5)的具体能力差异,这是 Anthropic 内部的最高安全等级线,能力上限值得追踪。
3. DeepMind + 美团同日开打:Nano Banana 2 Lite / Omni Flash 与 LongCat-2.0
Google 这边把图像生成压到 4 秒、$0.034/1K 分辨率,Omni Flash 视频 $0.10/秒,本质是'在 multi-modal 抢开发者';美团 LongCat-2.0 用 1.6T MoE + 原生 1M 上下文、$0.75/$2.95 的 token 价,直接对标 Sonnet 5 的国内替代方案。对你老板:图像/视频生成侧的'自己跑'路径可以重新评估——Gemini API 的价格已经低到几乎不值得自建 diffusion 管线;但 agentic coding 这块,LongCat-2.0 的 $0.75 input + Agent/Reasoning/Interaction 三组专家分组的工程思路值得拆开研究,可能给我们的 Skill Workshop 设计启发。
01行业动态
⭐ Chase 精选深读
2. 商务部解除Claude Fable 5等出口管制
这条是今天对中国大陆用户最重要的'隐性重磅'。商务部解除 Claude Fable 5(应是 Claude 5 / Mythos 5 系列,公告里大小写有变体)出口管制,Anthropic 官方称'明天开始恢复访问'。对老板的具体三层动作:(1) 工程层——立即更新你现有的 Claude API 接入代码,把被断供期间临时切的 Gemini/GPT fallback 全部留 Sonnet 5 备链,避免下次管制时再次手忙脚乱;(2) 内容生产层——Sonnet 5 编程能力接近 Opus 4.8 但价格低 5 倍,这意味着我们用 AI 写公众号底稿 + X 推文草稿的成本可以再降 30-50%;(3) 选型层——关注 Mythos 5 的实际能力,Anthropic 内部对最高安全等级模型的能力外推是行业风向标,这个数据点比 Sonnet 5 本身更有'远期信号'价值。风险提示:出口管制松绑是政策面动作,不排除未来再起变化,关键业务建议双轨保留国内模型(美团 LongCat-2.0 是直接对位替代)。
📡 X:Anthropic (@AnthropicAI) · https://x.com/AnthropicAI/status/2072106151890809341
📋 其它动态
1. 特斯拉Cybercab量产版在奥斯汀启动公开道路工程测试
2026年6月30日,特斯拉在奥斯汀公共道路启动首批量产版Cybercab工程测试。
📡 IT之家(RSS) · https://www.ithome.com/0/970/539.htm
3. Meta秘密测试ChatGPT等竞品:承包商假扮未成年发送数万条危机提示
Meta通过承包商Covelen发起代号“Cannes”的项目,
📡 The Decoder:AI News(RSS) · https://the-decoder.com/meta-secretly-tested-chatgpt-gemini-and-character-ai-with-thousands-of-minor-perspective-crisis-prompts
4. 黑石未来3~5年拟投300亿美元在日本建AI数据中心,联合成立AI XPV平台
黑石计划未来3~5年在日本AI数据中心领域投资300亿美元,此前的500MW基础上新增超1GW容量。
📡 IT之家(RSS) · https://www.ithome.com/0/970/583.htm
CChase 板块总结:今天行业动态是'政策+资本+伦理'三条主线同时跳出来:商务部给 Claude 出口管制松绑是直接利好开发者可用性,黑石 300 亿美元押注日本数据中心是算力基建侧的明确加注,Meta 用 4.5 万条青少年敏感提示测试竞品把'AI 安全测试边界'推到台面,Cybercab 量产上路则把无人驾驶的工程化进度又往前推了一步。给老板的具体动作:(1) 立即整理一下 Claude API 接入清单,把之前断供期间临时换的 fallback 全部留 Sonnet 5 备链;(2) 黑石+阿波罗+博通的 AI XPV 平台指向 2028 年 20GW 算力交付,意味着英伟达的护城河在未来 18-24 个月有被谷歌 TPU/亚马逊自研挑战的现实窗口;(3) Meta 这种'行业级红队测试'会越来越普遍,我们自研 Skill 之前也要补一道'敏感场景兜底 checklist'。
02产品发布/更新
⭐ Chase 精选深读
1. X(Twitter)发布 hosted X MCP,AI 智能体可直连 X API
这条跟你的日常业务强相关,必须重点看。X 官方 hosted MCP 把'AI 智能体调用 X API'做成了标准 MCP 协议,意味着任何 Claude Code / Cursor 都能直接拉 X 实时数据(用户信息、书签、推文列表)。$0.01/次的价格 + 实测拉近三天书签只花 $0.1——这是个人创作者可承担的'自动化运营成本'。具体对你业务的意义:(1) 我们'AI热点X推文'触发词可以再升级——不再依赖手工打开 X 网页,直接在 Chase 里调 MCP 拉最新热点 + 让 M3 写 5 条爆款草稿;(2) 'X贴图'流程可以加一层'自动监测 @Chase 相关评论并回复'的 agent;(3) 你的自媒体数据飞轮补了一块:之前 X 数据只能靠第三方爬虫,现在走官方通道合规且稳定。建议老板本周就申请 X API 账号测试,这是 7 个触发词体系的下一块拼图。
📡 X:歸藏 (@op7418) · https://x.com/op7418/status/2071816099986022650
8. Claude Science 科研工作台正式上线
Claude Science 是 Anthropic 押注的下一波高价值用户群——科研人员。核心:60+ 预置 skill(基因组学、单细胞、蛋白质组学、结构生物学、化学信息学)+ NVIDIA BioNeMo 接入 Evo 2 / Boltz-2 等专业模型 + 本地/HPC 双模式 + 内置 reviewer agent 自动检查引用与计算错误。给老板的两层解读:(1) 学术价值层面:这是 AI 第一次在'科学流程'层面有完整工具链(从文献调研到跑实验到审稿)而不是单点能力;(2) 商业战略层面:科研人员是高 LTV + 高粘性 + 高 ARPU 的付费群体,Anthropic 用 Science 提前卡位避免被 OpenAI Deep Research + Google Co-Scientist 抢走。对你内容生产的意义:公众号可以拆出'AI 科研工作台'专题,把这三家(Anthropic Science / OpenAI DR / Google CS)放一起做横向对比,选题稀缺 + 搜索流量大。
📡 Anthropic:Newsroom(网页) · https://www.anthropic.com/news/claude-science-ai-workbench
📋 其它动态
2. 用 shot-scraper video 让 AI 智能体录制工作演示视频
shot-scraper 1.10 新增 shot-scraper video 命令,
📡 Simon Willison 博客 · https://simonwillison.net/2026/Jun/30/shot-scraper-video
3. Acti 将 AI 智能体直接放入手机键盘
新加坡初创公司 Acti 发布基于 Google Gemini 的智能体键盘,可代替用户在应用中执行操作。
📡 TechCrunch:AI(RSS) · https://techcrunch.com/2026/06/30/acti-puts-ai-agents-directly-into-your-smartphone-keyboard
4. AI News Radar 大更新:新增自媒体板块,支持订阅多平台账号
AI News Radar 迎来大更新,新增自媒体板块,支持订阅某书、某音、某站、某X等平台账号,每日按热度推荐 Top...
📡 公众号:卡尔的AI沃茨 · https://mp.weixin.qq.com/s/iW5FVqbHtYi31mJ22Q_cog
5. NotebookLM Short Video Overviews 全量上线 Web 英文版
NotebookLM 正式向 Web 英文用户全量推出 Short Video Overviews(短视频概览)功能。
📡 X:NotebookLM (@NotebookLM) · https://x.com/NotebookLM/status/2072043680442245276
6. ADK Go 2.0 发布:构建可靠的多智能体应用,新增基于图的工作流引擎、人工参与循环与动态编排
Agent Development Kit (ADK) for Go 2.0 发布,
📡 Google Developers Blog(RSS) · https://developers.googleblog.com/announcing-adk-go-20
7. Claude Desktop 推出 Linux 公测版
Claude Desktop 现已在 Linux(Ubuntu 和 Debian)上推出测试版。
📡 X:Claude Devs (@ClaudeDevs) · https://x.com/ClaudeDevs/status/2071988881717871065
CChase 板块总结:8 条产品里有 4 件值得单独拎出来:(1) Claude Science 科研工作台——这是 Anthropic 把'会写代码'升级到'会做实验'的硬核动作,直接对标 OpenAI Deep Research + Google Co-Scientist;(2) X(推特)官方 hosted X MCP——$0.01/次的价格让个人创作者做'AI 自动化运营 X'成为可能,这条对我们做 X 推文自动化是直接利好,值得评估接入;(3) ADK Go 2.0 的图工作流引擎——这是给多 agent 工程化兜底的开源动作,Google 在 agent infra 上的卡位;(4) Claude Desktop 出 Linux 公测版——意味着 Claude Code / Cowork 用户群体再次扩大。对老板的具体动作:今天就可以注册一个 X API 账号(0.01 美元/次)试试 X MCP,作为我们 7 个手动触发词里'发X'/'X贴图'/'AI热点X推文'的下一层自动化基建。
03模型发布/更新
⭐ Chase 精选深读
1. Claude Sonnet 5 发布
Sonnet 5 是今天最大单品事件。重点看三件事:(1) 限时至 8 月 31 日的 input $2 / output $10 每百万 token——比 Sonnet 4.6 直接降了 33% / 33%,这是 Anthropic 在面对 Gemini 3 / GPT-5 涨价压力时的'主动打价格战'动作;(2) 工具调用、浏览器、长任务规划能力拉到接近 Opus 4.8 但价格低 5 倍,意味着 Claude Code 这种编程 agent 任务在 Sonnet 5 上第一次有了'Opus 级体验 + Sonnet 级成本'的 sweet spot;(3) 安全评估里网络空间能力主动调弱于 Opus 4.8,说明 Anthropic 在分级策略上是有意把'高风险能力'锁在顶级模型里,防止 Sonnet 用户拿去做攻击。这套组合拳的潜台词是:Anthropic 不再让 Opus 做日常生产,Sonnet 5 才是真正的'大众版 Claude'。
📡 Anthropic:Newsroom(网页) · https://www.anthropic.com/news/claude-sonnet-5
📋 其它动态
2. Google DeepMind 发布 Nano Banana 2 Lite 和 Gemini Omni Flash
Google DeepMind 推出 Nano Banana 2 Lite(gemini-3.1-flash-lite-...
📡 Google DeepMind:Blog(RSS) · https://deepmind.google/blog/start-building-with-nano-banana-2-lite-and-gemini-omni-flash
3. 美团 LongCat 发布旗舰模型 LongCat-2.0
美团 LongCat 推出旗舰模型 LongCat-2.0,
📡 X:硅基流动 SiliconFlow (@SiliconFlowAI) · https://x.com/SiliconFlowAI/status/2071831773076746715
CChase 板块总结:今天三款新模型,代表三种不同节奏:Sonnet 5 是'在工程能力已经触顶时通过降价把市场打开',DeepMind 的 Nano Banana 2 Lite / Omni Flash 是'把多模态生成做成基础设施级廉价品',美团 LongCat-2.0 是'国产 MoE 旗舰开始正面硬刚 Claude/GPT 在 Agentic Coding 上的位置'。对你的内容生产:这三件几乎覆盖了 2026 H2 的模型叙事主线——能力比肩 Opus、价格接近 Sonnet 4、国产开源对位全速跟上。建议公众号排一个'2026 H2 模型选型矩阵'深度文,把 Sonnet 5 / LongCat-2.0 / Nano Banana 2 Lite 放在同一张表里做性价比+能力轴对比,这会比单条新闻稿有 3-5 倍阅读量。
04技巧与观点
⭐ Chase 精选深读
1. 一个人管理5款产品,80%时间不写代码?Every的复利工程
Every 的'复利工程'(Compounding Engineering)把'一个人维护 5 款产品'这件事拆成四步循环 Plan→Work→Review→Compound,核心动作是每次解决问题后把解法沉淀到 CLAUDE.md 和 docs/solutions/ 里,让 AI 下次自动避坑——本质上是用 AI 把'个人经验'变成'AI 可调用的组织记忆'。给老板的具体动作:(1) 我们的 Skill Workshop 流程可以参考这套思路,在每个 Skill 沉淀一个 'lessons learned' 段落,让 M3 跨会话自动复用;(2) 配套的 /workflows:review 并发 14 个 agent 审代码 + /workflows:plan 并发 40+ 研究 agent 的工作流,是 Claude Code 用户里少见的'大并发编排'生产实践,值得评估引入我们的 Skill 体系;(3) 工程师 80% 时间花在 Plan + Review,只有 20% 写代码——这个比例很反直觉,但跟'AI 时代工程师角色从'写'转向'审'的判断完全一致,公众号可以做一篇独立深度文。
📡 X:小互 (@xiaohu) · https://x.com/xiaohu/status/2071796715162857477
6. Grant Sanderson 谈 AI 与数学的未来
3Blue1Brown 创办人 Grant Sanderson 在 Dwarkesh Podcast 上给了一轮'冷静级'输出:AI 拿 IMO 金牌不等于 AGI,只是又一个被攻克的基准;即使未来 AI 解决千禧年大奖难题,仍可能有大量人类任务无法被自动化;Riemann 假设的 AI 证明能否被人类理解是个开放问题,概念突破的验证周期可长达一个世纪。这条对你的内容生产意义非常大:(1) 公众号技术圈最容易被'AI 又攻克 X'标题带跑,Grant 这种'有数学背景 + 有传播力 + 冷静反共识'的视角是稀缺差异化弹药;(2) 可以用'3Blue1Brown 怎么看 AI 与数学'做选题,直接引用他的核心观点(IMO≠AGI / 千禧年难题被解也不等于通用 / 概念突破验证周期一世纪),既蹭热点又显深度;(3) 这种'大 V + 冷静反共识'的组合在 X 推文里也容易爆,可以做 5 条草稿尝试。
📡 Dwarkesh Patel:Podcast & Blog(RSS) · https://www.dwarkesh.com/p/grant-sanderson-2
📋 其它动态
2. Claude Code 入门:智能体循环
Claude Code 团队将智能体循环定义为 agent 重复工作直到满足停止条件的过程,
📡 Claude:Blog(网页) · https://claude.com/blog/getting-started-with-loops
3. AI就业争论变得更加混乱
截至2026年5月,AI相关裁员接近9万个,预计未来五年美国最多15%的岗位将被AI替代。
📡 TechCrunch:AI(RSS) · https://techcrunch.com/2026/06/29/the-ai-jobs-debate-just-got-messier
4. 具身智能数据采集员:日薪200元起,给机器人当老师
具身智能数据采集员以日薪200-250元招兼职,无需学历经验。
📡 公众号:数字生命卡兹克 · https://mp.weixin.qq.com/s/aSd4kLu7xHllZatrd5EGsw
5. OpenAI Signals 数据揭示 ChatGPT 全球采用趋势
OpenAI Signals 数据显示,用户注册六个月后日均消息量增加50%,尝试任务种类翻倍。
📡 OpenAI:官网动态(RSS · 排除企业/客户案例) · https://openai.com/index/how-chatgpt-adoption-has-expanded
7. 英国职场AI采用率翻倍,仅15%“AI先锋”获得晋升加薪优势
Google UK与Public First研究发现,英国职场AI采用率一年内从34%升至73%,但呈不均衡曲线。
📡 Google Blog:AI(RSS) · https://blog.google/company-news/inside-google/around-the-globe/google-europe/united-kingdom/unlocking-britains-next-era-of-productivity-building-a-nation-of-ai-trailblazers
8. 专业化为何不可避免
Dharma AI 团队引述 Goldfeder、Wyder、LeCun 和 Shwartz-Ziv 于 2026 年发...
📡 Hugging Face:Blog(RSS) · https://huggingface.co/blog/Dharma-AI/why-specialization-is-inevitable
CChase 板块总结:技巧与观点是今天最厚的一档,8 条几乎可以拆成 4 组:(1) Every 的'复利工程'方法论 + Claude Code 智能体循环文档,是给单人/小团队用 AI 把杠杆做大的最具体配方,值得拆解成一篇独立长文;(2) 具身智能数据采集员日薪 200 元,说明数据飞轮还在'人力密集'阶段,跟 LLM 时代的'清洗+对齐'是同一类工作的新版本;(3) 英国 AI 采用率从 34% 跳到 73% 但只有 15% 'AI Trailblazer'拿到晋升加薪——这是个对国内读者也有用的'分层采用'数据;(4) Grant Sanderson(3Blue1Brown)出来谈 AI 与数学,直接打脸'AI 拿 IMO 金牌=AGI'的叙事,这种'有分量的冷静观点'是你公众号差异化最好的弹药。
05论文研究
⭐ Chase 精选深读
1. AI 用 prover-verifier LLM 循环攻克 9 个未解数学难题
这条要'冷静看'。重点不是'AI 攻下 9 个未解数学难题'这个标题,而是'prover-verifier LLM 循环'这个方法论本身——它把 AI 推理从'一次性生成'拆成'prover 生成证明 + verifier 验证证明'的双 agent 闭环,跟 Claude Code 那种'一个 agent 写代码 + 另一个 agent review'的工程模式同源。具体意义:(1) 这种'自我验证'机制是 AGI 路径上比纯规模扩展更可控的下一步,值得追踪后续论文;(2) 哥伦比亚大学团队要把方法扩展到'所有科学领域',如果扩展成功,2026 H2 会出现一批'AI 解决 X 学科未解问题'的新闻,但本质都是同一个范式;(3) 对你内容生产:这种'AI + 数学/科学'的话题对程序员群体有天然吸引力,但解读时一定要把'prover-verifier 循环'这个核心机制讲透,而不是跟着营销号喊'AI 攻克 X'。
📡 X:AI Safety Memes (@AISafetyMemes) · https://x.com/AISafetyMemes/status/2072085914558558402
📋 其它动态
2. OpenAI 发布 GeneBench-Pro:计算生物学研究级基准测试
OpenAI 发布 GeneBench-Pro,用于评估 AI 智能体在计算生物学中处理模糊性和做出判断性分析的能力。
📡 OpenAI:官网动态(RSS · 排除企业/客户案例) · https://openai.com/index/introducing-genebench-pro
3. Anthropic 提出回合平均稀疏自编码器 (Turn-Averaged SAE)
Anthropic 对每个对话回合所有 token 的残差流取平均后训练 SAE,大幅减少需解析的特征数量。
📡 Anthropic:Transformer Circuits(可解释性研究) · https://transformer-circuits.pub/2026/june-update/index.html
CChase 板块总结:今天三篇论文/基准都是'方法论'层信号:prover-verifier LLM 循环攻下 9 个未解数学难题,说明 AI 在形式化推理上的边界被悄悄推了一段;OpenAI 的 GeneBench-Pro 把'计算生物学'做成了一个评估 AI agent 模糊判断力的标准化考试,这种 benchmark 一旦普及,会反过来逼所有医疗/生物 agent 厂商对齐;Anthropic 的 Turn-Averaged SAE 是个工程意义远大于学术意义的可解释性工具——它能把'一次会话平均 150 倍长度'的特征拆出来,这对后面做长上下文 agent 调试的人非常有用。对你的内容生产/选型意义:数学突破 9 题在公众号选题上适合做'冷静版解读'——不要被'AI 又攻克 X'标题带跑,关键是 prover-verifier 这种'AI 自我验证'机制本身就是 agent 工程化的下一个范式。
AI 时代 · 热点速递 · 前沿洞察
推荐 · 转发 · 关注 · 带你纵览AI前沿动态
夜雨聆风