
AI for Science 从模型解题走向科研工作台闭环Claude Science、GeneBench-Pro、Fable 5 治理与全栈成本竞争同步推进
信号等级🔴 高影响🟡 中影响⚪ 信息流 关键趋势
AI for Science 从“模型能解题”进入“研究工作台能闭环”
核心观点:Claude Science、OpenAI GeneBench-Pro、Meta Brain2Qwerty v2 和 NVIDIA Nemotron-TwoTower 都在围绕一个问题展开:AI 不只是给出答案,而要能在真实科研流程中处理工具、数据、审计、复现和判断。
关键数据:Claude Science 连接 60+ 科学数据库,支持 macOS/Linux、本地/SSH/HPC 环境和单 GPU 到数百 GPU 扩展;OpenAI GeneBench-Pro 有 129 个计算生物学问题,覆盖 10 个领域和 21 个子领域;Brain2Qwerty v2 在非侵入式 MEG 场景达到 61% 平均词准确率。
批判性判断:科研 agent 的护城河会从“某个 benchmark 第一”转向“实验室是否敢把数据和流程交给它”。本地运行、可审计 artifact、引用和计算校验,比单次推理能力更接近购买理由。
→ 详情:
https://www.anthropic.com/news/claude-science-ai-workbench
https://openai.com/index/introducing-genebench-pro/
https://www.marktechpost.com/2026/06/30/meta-ai-releases-brain2qwerty-v2-a-non-invasive-meg-brain-to-text-pipeline-decoding-typed-sentences-at-61-word-accuracy/
大厂动向
🔴1、Anthropic 发布 Claude Sonnet 5:在 Claude 和 API 上线,缩小与 Opus 系列差距
Claude Sonnet 5 接近 Opus 4.8 能力且价格更低,默认进入 Free 和 Pro。信号是 Anthropic 继续把高能力模型下沉到更高频、更低门槛的产品层。
→ 详情:https://www.anthropic.com/news/claude-sonnet-5
🔴2、Anthropic 推出 Claude Science:面向研究人员的 AI 科研工作台
Claude Science 连接 60+ 科学数据库,支持本地和 HPC 工作流,并提供可审计科研 artifacts。重点不只是“答题”,而是把工具、数据、计算环境和审计材料纳入研究闭环。
→ 详情:https://www.anthropic.com/news/claude-science-ai-workbench
🟡3、NotebookLM 新增 AI Clips:把你的笔记生成 60 秒 TikTok 短视频
Google NotebookLM 正在推出 TikTok 风格的短视频概览功能,可基于用户上传的资料生成 60 秒竖屏视频,包含 AI 图像和旁白。
→ 详情:https://www.theverge.com/tech/959778/google-notebooklm-ai-clips
🔴4、AWS 投入 10 亿美元组建 FDE 团队,帮客户落地 AI 与智能体
典型模式是每批 5-6 组工程师,驻场约 45 天;新部门最终员工规模可达数千人,首批客户包括 NBA 与理光。AWS 的方向是用前线工程团队把 AI 和 agent 从演示推进到客户真实流程。
→ 详情:https://www.ithome.com/0/971/071.htm
🟡5、美团 LongCat-2.0 发布:国产算力集群训练的万亿参数模型
LongCat-2.0 总参数 1.6T,平均激活约 48B,支持 1M 上下文并在国产算力集群训练。
🟡6、X 推出 hosted X MCP:实时社交数据成为 agent 工具链入口
AI agent 可通过 MCP 调用 X API 获取和分析实时社交数据,实时信息流正在成为 agent 工具链的一部分。
→ 详情:https://x.com/op7418/status/2071816099986022650
初创动向
🟡1、Acti 发布 AI 输入法键盘并获 530 万美元种子轮融资
Acti 基于 Google Gemini,可在邮件、聊天、社交应用中执行操作,而不仅是预测下一个词。其 Skills 功能允许用户用自然语言把长按某个键绑定到多步骤任务,例如翻译消息或发送会议链接;两周内测试用户创建超 1000 个 Skills。
→ 详情:https://techcrunch.com/2026/06/30/acti-puts-ai-agents-directly-into-your-smartphone-keyboard/
生态动向
🔴1、Anthropic 宣布 Fable 5 7 月 1 日恢复:模型发布治理进入新阶段
Fable 5 全球恢复访问,新分类器阻断特定 jailbreak 超 99%,并推动行业严重性评估框架。模型发布治理正在从“上线/下线”走向可解释的安全评估与恢复机制。
→ 详情:https://www.anthropic.com/news/redeploying-fable-5
观点与深度
🟡1、OpenAI Signals:ChatGPT 使用从英语核心市场扩散到更全球化用户结构
OpenAI 称非英语用户已超过活跃用户一半,低 HDI 国家相对增长最快。ChatGPT 的增长正在从英语核心市场扩散到更全球化的用户结构。
→ 详情:https://openai.com/index/how-chatgpt-adoption-has-expanded/
🟡2、Training Data 访谈 SemiAnalysis:AI 真正的 100x 可能来自软硬件协同设计
访谈强调模型、芯片、网络、数据中心和软件栈协同优化,才是长期 AI 成本竞争关键。Patel 提到通用硬件未必适合所有 LLM 工作负载,Google 内部也存在多条 TPU 架构路线;同时,长周期 agent 需求推高算力紧张,今年数据中心新增功率按访谈口径仍会非常激进。这与 AWS 驻场工程、DeepSeek 峰谷定价、NVIDIA TwoTower 形成同一条线:AI 成本竞争正在从 token 单价扩展到全栈协同优化。
→ 详情:https://www.youtube.com/watch?v=f6D_aiy8qyU
AI for Science 从模型解题走向科研工作台闭环Claude Science、GeneBench-Pro、Fable 5 治理与全栈成本竞争同步推进
关键趋势
AI for Science 从“模型能解题”进入“研究工作台能闭环”
核心观点:Claude Science、OpenAI GeneBench-Pro、Meta Brain2Qwerty v2 和 NVIDIA Nemotron-TwoTower 都在围绕一个问题展开:AI 不只是给出答案,而要能在真实科研流程中处理工具、数据、审计、复现和判断。
关键数据:Claude Science 连接 60+ 科学数据库,支持 macOS/Linux、本地/SSH/HPC 环境和单 GPU 到数百 GPU 扩展;OpenAI GeneBench-Pro 有 129 个计算生物学问题,覆盖 10 个领域和 21 个子领域;Brain2Qwerty v2 在非侵入式 MEG 场景达到 61% 平均词准确率。
批判性判断:科研 agent 的护城河会从“某个 benchmark 第一”转向“实验室是否敢把数据和流程交给它”。本地运行、可审计 artifact、引用和计算校验,比单次推理能力更接近购买理由。
→ 详情:
https://www.anthropic.com/news/claude-science-ai-workbench
https://openai.com/index/introducing-genebench-pro/
https://www.marktechpost.com/2026/06/30/meta-ai-releases-brain2qwerty-v2-a-non-invasive-meg-brain-to-text-pipeline-decoding-typed-sentences-at-61-word-accuracy/
大厂动向
1、Anthropic 发布 Claude Sonnet 5:在 Claude 和 API 上线,缩小与 Opus 系列差距
Claude Sonnet 5 接近 Opus 4.8 能力且价格更低,默认进入 Free 和 Pro。信号是 Anthropic 继续把高能力模型下沉到更高频、更低门槛的产品层。
→ 详情:https://www.anthropic.com/news/claude-sonnet-5
2、Anthropic 推出 Claude Science:面向研究人员的 AI 科研工作台
Claude Science 连接 60+ 科学数据库,支持本地和 HPC 工作流,并提供可审计科研 artifacts。重点不只是“答题”,而是把工具、数据、计算环境和审计材料纳入研究闭环。
→ 详情:https://www.anthropic.com/news/claude-science-ai-workbench
3、NotebookLM 新增 AI Clips:把你的笔记生成 60 秒 TikTok 短视频
Google NotebookLM 正在推出 TikTok 风格的短视频概览功能,可基于用户上传的资料生成 60 秒竖屏视频,包含 AI 图像和旁白。
→ 详情:https://www.theverge.com/tech/959778/google-notebooklm-ai-clips
4、AWS 投入 10 亿美元组建 FDE 团队,帮客户落地 AI 与智能体
典型模式是每批 5-6 组工程师,驻场约 45 天;新部门最终员工规模可达数千人,首批客户包括 NBA 与理光。AWS 的方向是用前线工程团队把 AI 和 agent 从演示推进到客户真实流程。
→ 详情:https://www.ithome.com/0/971/071.htm
5、美团 LongCat-2.0 发布:国产算力集群训练的万亿参数模型
LongCat-2.0 总参数 1.6T,平均激活约 48B,支持 1M 上下文并在国产算力集群训练。
6、X 推出 hosted X MCP:实时社交数据成为 agent 工具链入口
AI agent 可通过 MCP 调用 X API 获取和分析实时社交数据,实时信息流正在成为 agent 工具链的一部分。
→ 详情:https://x.com/op7418/status/2071816099986022650
初创动向
1、Acti 发布 AI 输入法键盘并获 530 万美元种子轮融资
Acti 基于 Google Gemini,可在邮件、聊天、社交应用中执行操作,而不仅是预测下一个词。其 Skills 功能允许用户用自然语言把长按某个键绑定到多步骤任务,例如翻译消息或发送会议链接;两周内测试用户创建超 1000 个 Skills。
→ 详情:https://techcrunch.com/2026/06/30/acti-puts-ai-agents-directly-into-your-smartphone-keyboard/
生态动向
1、Anthropic 宣布 Fable 5 7 月 1 日恢复:模型发布治理进入新阶段
Fable 5 全球恢复访问,新分类器阻断特定 jailbreak 超 99%,并推动行业严重性评估框架。模型发布治理正在从“上线/下线”走向可解释的安全评估与恢复机制。
→ 详情:https://www.anthropic.com/news/redeploying-fable-5
观点与深度
1、OpenAI Signals:ChatGPT 使用从英语核心市场扩散到更全球化用户结构
OpenAI 称非英语用户已超过活跃用户一半,低 HDI 国家相对增长最快。ChatGPT 的增长正在从英语核心市场扩散到更全球化的用户结构。
→ 详情:https://openai.com/index/how-chatgpt-adoption-has-expanded/
2、Training Data 访谈 SemiAnalysis:AI 真正的 100x 可能来自软硬件协同设计
访谈强调模型、芯片、网络、数据中心和软件栈协同优化,才是长期 AI 成本竞争关键。Patel 提到通用硬件未必适合所有 LLM 工作负载,Google 内部也存在多条 TPU 架构路线;同时,长周期 agent 需求推高算力紧张,今年数据中心新增功率按访谈口径仍会非常激进。这与 AWS 驻场工程、DeepSeek 峰谷定价、NVIDIA TwoTower 形成同一条线:AI 成本竞争正在从 token 单价扩展到全栈协同优化。
→ 详情:https://www.youtube.com/watch?v=f6D_aiy8qyU

关于我们
探微观智聚焦AI产品和创作,思考下一代AI原生产品和交互灵感。从ToC产品创新,到模型、平台、生态、资本、观点报告等上下游迭代趋势,以一线产品实战视角切入,拆解可复用的“AI产品灵感基础模块”,每日更新。

联系我们:进入探微观智公众号,选择“企业合作”。
☯️从罗振宇到冯友兰:AI时代人类生存指南 ☯️李继刚:人与AI的关系—写日记可能是人在AI时代最无悔的事情 👨Manus的 AI 产品心法:从“品味”到“护城河”、从“取舍”到“增长”的深度解读 ☁️A16Z Big Ideas 2026:关于2026年科技趋势的47条“剧透”,AI 走出屏幕,物理世界可“编程”
🐒给打工人:AI赋能人工,从入门到精通.pdf 🐒给老板:AI替代人工,从入门到精通.pdf ✍️AI-native组织协作指南.pdf 💰AI公司的商业化难题:别再用 ToC 和 ToB 给 AI 公司贴标签了 🤖为什么 Anthropic 能做出大厂做不出来的模型和 Agent? 🦞龙虾系列08|我把 Karpathy 的"个人知识库"工作流做成了一键可用的工具 🦞龙虾系列07|Anthropic 在命令行里养了 18 只宠物:Claude Code “Buddy”宠物系统对于“效率×陪伴”产品的四个启示 🦞龙虾系列06|拆解Claude code源代码,发现好的Agent架构和好的公司管理,底层逻辑是相通的 🦞龙虾系列05|我用7个Agent模拟了一场“艺术与科技跨界孵化”的讨论:AI时代,最适合诞生下一个“达芬奇” 🦞龙虾系列04|OpenClaw 和它的四个"挑战者"都在做什么 🦞龙虾系列03|解剖Agent,发现其实没有“魔法”,Agent = 模型 + Harness 🦞龙虾系列02|关于 OpenClaw 帮你赚钱的机会:A2A 生态起来后,钱会流向哪里 🦞龙虾系列01|OpenClaw 与 AI Agent 时代:当 How 被自动化,人还剩下什么? 👾Web 4.0:当 AI 不再需要人类“批准”时,会发生什么?软件的用户不再是人类,AI直接帮你赚钱 ❤️🔥ELYS 深度测评:当社交圈里住进了硅基生命,价值其实不在社交本身(含50个独家邀请码) 🪄一手测评AnyGen:字节版NoteBookLM + Manus,幻觉少、不废话!把“麦肯锡能力”开放给每个人,还能做漫画和3D粒子魔法特效
🙋AI周报|Agent入口之争从“抢用户时间”变成“抢任务现场”;Agent越像劳动力,越需要制度,而不只是benchmark 🙋AI周报|AI开始进实验室、超级App和支付账户(6.14-6.20) 🙋AI周报|Fable 5四日下线,Kimi开卡,微信Skill和Apple Siri作系统入口 🙋AI周报 | 微软Project Solara争当“一核多端”跨设备OS,李飞飞重立世界模型分类法 🙋AI周报 | 支付宝基建 Agent 经营路,Opus 四点八产品化组合拳 🙋AI周报 |OpenAI 五千亿筹备上市 Google 三协议铺路通商 🙋AI周报 | Agent 掌柜入了账房、模型破了回合制 🙋AI周报|Codex 升堂夺嫡争通用,外壳封装另起炉灶新 (Harness-as-a-Service) 🙋AI周报 五一合集|AI 商业化拐点到来:豆包付费、但 AI 订阅经济学失衡
夜雨聆风