乐于分享
好东西不私藏

每日AI动态·Coding与具身

每日AI动态·Coding与具身

每日AI动态·2026/07/25|Coding与具身智能

今日聚焦:AI Coding 价格与范式双线震荡,具身智能从"秀肌肉"全面转向"晒工单"。

🚀 Claude Opus 5 发布:半价追平 Fable 5,编程基准登顶

事件内容

7 月 24 日夜至 25 日凌晨,Anthropic 正式发布新一代旗舰模型 Claude Opus 5 并全平台上线。API 定价每百万 token 输入 5 美元、输出 25 美元,与前代 Opus 4.8 完全一致、仅为被下架的 Fable 5 的一半。在 Frontier-Bench v0.1 登顶,CursorBench 3.2 以一半成本逼近 Fable 5,ARC-AGI 3 得分达次优模型的 3 倍,OSWorld 2.0 以三分之一成本反超 Fable 5(仅网络安全任务落后 Mythos 5)。Claude Code v2.1.219 同步将其设为默认 Opus 模型,提供 1M 上下文窗口,fast 模式定价 $10/$50,并默认将嵌套子 Agent 派生深度从 1 放宽至 3、新增 sandbox.network.strictAllowlist(非白名单主机静默拦截)。

值得关注的原因

这是 AI Coding 领域一次典型的"加量不加价":用 Opus 4.8 的价格把能力顶到 Fable 5 量级,等于直接把前沿编程模型的门槛砍半。对任何已在 Max/Pro 上跑 Opus 的团队,今天零成本自动升级;而长上下文 + 更深子 Agent 嵌套,意味着 Claude Code 有能力承接更长的"工程队"式任务。对 Cursor、Codex 等竞品构成直接压力。


✂️ Anthropic 删掉 80% 系统提示词,上下文工程范式转向

事件内容

随 Opus 5 上线,Anthropic 团队成员发帖称 Claude Code 删除了约 80% 的系统提示词;官方随后发布上下文工程新指南,披露对 Opus 5、Fable 5 等强推理模型砍掉八成系统提示后仍无性能下降。方法论从"刚性规则"转向"信任模型判断":用富有表现力的工具接口替代大量示例、上下文延迟加载而非前置灌入、CLAUDE.md 只记"坑"而非模型能自己发现的细节。同期 Anthropic 还发布了模型选型指南,建议团队从最强通用模型起步。

值得关注的原因

这标志 AI Coding 的"提示工程时代"正在让位于"上下文工程/信任模型"时代。当模型足够强时,冗长提示词反而起反作用——这对所有在做 Coding Agent、写 system prompt 的团队都是范式级提醒:少即是多,工具接口设计比堆提示更关键。也解释了为何 ZCode、Codex 等纷纷转向"Goal/工作流"式设计而非堆指令。


🔓 黄仁勋联名 25 家巨头力挺开放权重,开源路线之争白热化

事件内容

7 月 24 日晚,黄仁勋在 X 发出首条推文,附《开放权重与美国在 AI 领域的领导地位》联合公开信,英伟达、Meta、微软、Hugging Face 等 25 家机构联名,呼吁审慎制定开源模型权重管理规则。OpenAI、Anthropic、谷歌三大闭源厂商集体缺席,技术路线与监管立场分歧公开化。同一日,吴恩达在 LinkedIn 宣布开源桌面 AI 智能体 OpenWorker(基于 aisuite,macOS 版已上线、Windows 在途,已获 3.7k Star);独立研究者用 RuBench(25 个俄语客户式请求)测试揭示主流 Coding Agent 榜单测的其实是"产品 safeguard"而非纯模型能力。

值得关注的原因

开源 vs 闭源的路线之争从口头辩论升级为公开信对垒,直接关系国产 GLM-5.2、Kimi、Qwen 等开放权重模型的全球生存空间。吴恩达下场做开源 Agent + RuBench 戳穿榜单"隐形之手",说明 AI Coding 竞争焦点正从"模型军备竞赛"切到"入口、Harness 工程与评测方法论"。


🦾 宇树落子成都,具身智能"头部五强"集齐

事件内容

7 月 24 日,宇树科技在成都春熙路全球首发 GD01 量产版载人变形机甲(约 3 米高、高强度合金、双足/四足两态切换、座舱嵌入成都 IP"武武熊猫"),并举办机器人街头争霸赛。同日下午,宇树全国首个面向基础教育的具身智能实验室在嘉祥外国语学校揭牌(遥控/动作捕捉/人形实训三系统),锦江区将首批推广 10 所学校。宇树还与成都市政府签署战略合作协议。至此,宇树、优必选、智元、银河通用、星动纪元五大头部全部完成在蓉布局。

值得关注的原因

宇树补齐了具身智能头部阵营在成都的最后一块拼图,城市级"研发—场景—数据—教育"生态开始闭环。从载人机甲到校园实验室,说明头部玩家抢的不只是产线,更是人才苗圃与城市场景入口——具身智能的竞争正从"谁能造出来"转向"谁能扎根城市真实运转"。


🏭 具身智能"部署落地元年":从炫技到干活,灵巧手寿命成短板

事件内容

WAIC 2026 落幕近一周,具身智能首次与智算并列为核心赛道,参展企业从去年 80 余家增至 200 多家,叙事从"能跑多快"转向"能干什么活"。智元将 2026 年定为"部署态元年",精灵 G2 Max 与京东物流仓储落地为人形机器人首次真实生产场景部署;工信部预计全年整机产量有望破 10 万台。但第一财经同日揭露真实拷打:部分灵巧手抓 5 公斤物品约 50 次即损坏,头部厂商因时去年出货超 1 万台、极智嘉称市面头部灵巧手寿命约 30–50 万次(低自由度),离工业"万次不坏"合格线仍有距离。

值得关注的原因

"部署态元年"的乐观叙事背后,核心零部件可靠性是绕不开的硬伤。灵巧手寿命直接决定机器人能否真正进工厂——这折射出整条供应链尚未成熟。对投资与产业而言,2026 的关键指标不再是能演示什么,而是"插上电能否稳稳干一个月活"。供应链催熟速度,将决定量产元年能否兑现。


今日信号小结

方向信号关键动作影响
----------------------------
AI Coding前沿模型降价Claude Opus 5 半价追平 Fable 5编程 Agent 门槛腰斩,竞品承压
AI Coding提示工程退潮删 80% 系统提示词,转向信任模型上下文工程成新范式
开源生态路线公开分裂黄仁勋+25 家联名 VS 闭源三巨头开放权重模型全球空间受关注
具身智能头部生态闭环宇树落子成都,五强集齐城市级场景/人才争夺升温
具身智能从表演到落地部署态元年,灵巧手寿命短板供应链可靠性的真实大考

*数据来源:claude-news.today、my2cents.ai、机器之心、智东西、IT之家、腾讯新闻、界面新闻、第一财经、中国经营报、财新、36氪、甲子光年、封面新闻、新浪财经、网易科技。*