DAILY AI BROADCAST / 2026.07.01
今日 AI 日报:07.01 的 26 条变化
模型发布、智能体工具和实践观察一起更新。本期按模型、产品、行业、研究和实践拆开,帮你快速看清今天哪些 AI 变化值得跟进。
先抓四条线:模型发布、智能体工具、实践观察和产业信号。今天的重点不只是哪家公司发布了什么,也包括这些变化会进入哪些工具、行业和使用场景。
SECTION / 3 STORIES
模型发布/更新
Claude Sonnet 5 发布
Claude Sonnet 5 是 Anthropic 推出的最新 Sonnet 模型,具备计划、浏览器和终端工具使用能力,可自主运行。
性能接近 Opus 4.8,定价更低:即日起至 2026 年 8 月 31 日,输入 token $2/百万,输出 $10/百万,之后恢复为 $3/百万输入和 $15/百万输出 相比 Sonnet 4.6,在推理、工具使用、编程和知识工作等智能体能力上大幅提升
Nano Banana 2 Lite 与 Gemini Omni Flash
Nano Banana 2 Lite 主打更快、更低成本的图像生成。
Gemini Omni Flash 支持高画质视频生成和对话式编辑 视频输出定价为每秒 0.10 美元
LongCat-2.0 旗舰模型发布
美团 LongCat 推出旗舰模型 LongCat-2.0,采用 1.6T 参数 MoE 架构(约 48B 活跃参数),原生支持 1M 上下文窗口。
定价为 Input Cache $0.015/1M tokens、Input $0.75/1M tokens、Output $2.95/1M tokens 模型专为 Agentic Coding 设计,包含三大技术:LSA 稀疏注意力实现高效 1M 扩展
SECTION / 8 STORIES
产品发布/更新
X MCP 直连 AI 智能体
X(Twitter)官方推出 hosted X MCP,AI 智能体可通过 MCP 协议直接调用 X API 获取实时信息,支持 Grok。
用户需注册 X API 并按量付费,个人优惠价每次调用 0.01 美元(1 美元 1000 次) 有用户实测拉取近三天书签仅花 0.1 美元
shot-scraper video 录制演示
shot-scraper 1.10 新增 shot-scraper video 命令,支持通过 storyboard.yml 文件定义操作步骤。
演示视频展示了 Datasette 中从粘贴的 CSV/TSV/JSON 数据创建新表的功能 该功能依赖 Playwright 1.61.0 新增的 screencast 机制,解决了此前视频开头白帧、宽度固定 800px 等问题
Acti 将 AI 智能体直接放入手机键盘
新加坡初创公司 Acti 发布基于 Google Gemini 的智能体键盘,可代替用户在应用中执行操作。
核心功能 Skills 允许用自然语言创建快捷方式,如长按 T 键翻译消息、C 键发送会议链接 早期测试者两周内创建超 1000 个 Skills
AI News Radar 大更新
新增自媒体板块,可订阅多个平台账号。
每日按热度推荐 Top10 信息 保留热度优先和时间优先两种视图
NotebookLM 短视频概览上线
NotebookLM 正式向 Web 英文用户全量推出 Short Video Overviews(短视频概览)功能。
该功能可将复杂资料自动转化为 60 秒竖屏视频,深入讲解任意概念 此前,这一功能已面向 Google AI Ultra 和 Pro 订阅者(移动端及 Web)推出,免费用户即将可用
ADK Go 2.0 发布
Agent Development Kit (ADK) for Go 2.0 发布,引入了一类基于图的工作流引擎,用于组合复杂多智能体应用。
新版本内置人工参与循环(HITL)编排、使用纯 Go 代码的动态执行、以及指数退避重试等自动弹性特性 统一执行模型后,单智能体应用与复杂图均运行在同一运行时上,简化了遥测与状态持久化
Claude Desktop 推出 Linux 公测版
Claude Desktop 在 Ubuntu 和 Debian 推出测试版。
付费计划用户可获得桌面体验 覆盖 Claude Code、Claude Cowork 和聊天场景
Claude Science 科研工作台正式上线
Anthropic 推出 AI 科研工作台 Claude Science,整合常用工具与计算资源,支持从文献分析到多步骤研究的全流程。
提供超 60 项预配置技能与连接器,覆盖基因组学、单细胞、蛋白质组学、结构生物学、化学信息学等领域 可在macOS/Linux本地运行,或通过SSH/HPC远程使用
SECTION / 4 STORIES
行业动态
Cybercab 量产版上路测试
2026年6月30日,特斯拉在奥斯汀公共道路启动首批量产版Cybercab工程测试。
车辆无方向盘与脚踏板,配有安全监督员,马斯克发布实拍视频 从2024年10月概念车首秀到实车上路约20个月
商务部解除Claude Fable 5等出口管制
通知显示 Claude Fable 5 和 Mythos 5 的出口管制已解除。
相关访问计划恢复 后续进展还会继续公布
Meta 秘密测试竞品安全
Meta 通过承包商发起代号 Cannes 的测试项目。
项目雇佣数百人假扮未成年人 2025 年 8 月一轮测试发送超过 4.5 万条提示
黑石加码日本 AI 数据中心
黑石计划未来 3 到 5 年在日本 AI 数据中心投资 300 亿美元。
将在此前 500MW 基础上新增超过 1GW 容量 黑石认为真正风险是算力短缺而非基建泡沫
SECTION / 3 STORIES
论文研究
prover-verifier 攻克数学难题
AI Safety Memes 推文指出,AI 刚刚解决了 9 个未解决的数学问题,但全球没有记者报道。
引用 @WeinsteinOmri 的推文称,采用“prover-verifier”LLM 循环的方法,成功解决了理论计算机科学中 9 个重大开放问题 该研究由哥伦比亚大学合作者完成,并计划将这一方法扩展到所有科学领域
OpenAI 发布 GeneBench-Pro
OpenAI 发布 GeneBench-Pro,用于评估 AI 智能体在计算生物学中处理模糊性和做出判断性分析的能力。
该基准包含 129 个问题,覆盖统计遗传学、群体遗传学等 10 个领域 21 个子领域 每个问题提供真实混乱的数据集和实验背景,要求模型探索数据、选择分析路径并迭代实验
Turn-Averaged SAE 研究
把每个对话回合的 token 残差流取平均后训练 SAE。
实验使用 Qwen-2.5-7B-Instruct 和 LMSYS-Chat-1M 数据集 评测中区分度为 74%,低于每 token SAE 的 95%
SECTION / 8 STORIES
技巧与观点
Every 复利工程方法
媒体软件公司Every公开「复利工程」方法论,以单人工程团队维护5款产品。
核心是四步循环:Plan→Work→Review→Compound,其中Compound将每次解决问题的解法写入CLAUDE.md和docs/solutions/,使AI下次自动避坑 工程师80%时间花在Plan和Review,仅20%用于写代码
Claude Code 入门
文章还介绍了如何编写 SKILL.md 文件将人工验证步骤编码,让 Claude 进行端到端自检,减少 turn-based 循环中的手动操作。
AI就业争论变得更加混乱
截至2026年5月,AI相关裁员接近9万个,预计未来五年美国最多15%的岗位将被AI替代。
但Ramp与Revelio Labs对近22,000家公司的报告发现,高AI投入企业(前三个月人均月均支出30美元)总员工数增长10.2%,入门级岗位增长12% 报告认为AI并非普遍导致岗位消失,而是在资源充裕的科技企业里成为扩张工具——降低工程、销售、客服等职能的生产成本,从而推动整体增员
具身智能数据采集员
具身智能数据采集员以日薪200-250元招兼职,无需学历经验。
面试先测量身高体重以适配采集手套,并询问是否晕VR 工作分两种:遥操作采集——穿戴设备控制双臂机器人完成分拣积木、叠纸杯等动作
ChatGPT 全球采用趋势
OpenAI Signals 数据显示,用户注册六个月后日均消息量增加50%,尝试任务种类翻倍。
自2023年7月以来,各大洲活跃用户均大幅增长,非洲和亚洲增速最快,低人类发展指数国家增长尤为显著 用户群体更加多元化,女性名字用户已占全球多数,巴西、哥伦比亚、波兰和纳米比亚等国女性用户显著多于男性
Grant Sanderson 谈 AI 与数学的未来
3Blue1Brown 创办人 Grant Sanderson 正在制作记录 AI 在数学领域进展的新项目。
他在与 Dwarkesh Patel 的对谈中指出,AI 在 IMO 获金牌并不等于 AGI,只是又一个被攻克的基准 即使 AI 未来解决千禧年大奖难题,仍可能存在大量人类任务无法被自动化
英国职场 AI 采用率翻倍
Google UK与Public First研究发现,英国职场AI采用率一年内从34%升至73%,但呈不均衡曲线。
仅15%的“AI Trailblazers”(深度用户)晋升概率高84%、绩效高88%、加薪概率高55%,每周节省近8小时 其余85%仍处于旁观、实验或实践阶段
专业化为何不可避免
2026 年论文从优化理论、生物学和竞争市场讨论专业化。
无免费午餐定理认为通用算法平均表现并不占优 有限资源下,专门适配具体任务更有优势
ONE LINE SUMMARY
模型发布、智能体工具和实践观察一起更新。
夜雨聆风