AI日报
07月22日
今日汇总 13 条消息,其中头条要闻 5 条,工具上新 5 条,职场相关 3 条。
头条要闻
01Google DeepMind 发布三款 Gemini 新模型,3.5 Pro 仍未上线
Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。3.6 Flash 面向编码、知识工作和多模态任务,官方称 token 用量较上一代最多降低 17%;Flash-Lite 主打低成本,Flash Cyber 则面向政府及可信合作伙伴的漏洞发现与修复场景。对打工人而言,这意味着日常总结、代码辅助和批量自动化可以优先测试更快更便宜的 Flash 系列,而不是所有任务都调用旗舰模型。
🔗 https://techcrunch.com/2026/07/21/google-releases-three-new-gemini-models-but-no-3-5-pro · TechCrunch:AI(RSS)
02腾讯混元开源 Hyra-1.0,探索递归自我改进的科研智能体
腾讯混元发布 Hyra-1.0,将研究、实验和自我改进放进同一套智能体框架;官方披露其在 NanoChat 等任务上超过公开的 Recursive 结果,并在 55 个数学开放问题中刷新 29 个历史最好结果,相关产物已开源。对打工人而言,科研智能体正在从“帮你查资料”走向“提出假设—验证—迭代”,复杂调研和方案论证值得尝试把任务拆成可重复的循环流程。
🔗 https://www.ithome.com/0/979/440.htm · IT之家 (ITHome)
03Anthropic:Claude 已承担 Claude Code 团队约 65% 的产品工程 PR
Anthropic 团队在访谈中透露,Claude 目前已承担 Claude Code 团队约 65% 的产品工程 PR;同时,Claude Code 的系统提示词近期缩减约 80%,自动化代码审查更多覆盖产品“外层”变更。对打工人而言,AI 编程的价值不只是生成代码,需求拆解、审查和小步交付也在被自动化,个人工作流应尽早建立“人定目标、AI执行、人工验收”的闭环。
🔗 https://simonwillison.net/2026/Jul/21/cat-and-thariq · Simon Willison 博客
04Magic Leap 转向 AI 眼镜光波导供应商,并计划裁员 193 人
AR 企业 Magic Leap 宣布不再专注于自研整机,而是转型为面向 AI 智能眼镜厂商的光波导供应商和设备集成伙伴;公司同时计划在佛罗里达州总部裁员 193 人。对打工人而言,AI 硬件产业链正在从“做整机”转向“做关键零部件和平台”,相关岗位机会会更多集中在光学、端侧 AI、供应链和行业解决方案等环节。
🔗 https://www.ithome.com/0/979/774.htm · IT之家 (ITHome)
05中国电信完成 5G 无线网络规划大模型现网试点,效率提升 50%
中国电信完成 5G 无线网络规划大模型现网试点,披露规划效率提升 50%、方案准确率达到 75% 以上,并实现规划设计方案自动输出和建设效果预测。对打工人而言,AI 落地正在进入通信、工程等具体业务流程,真正有竞争力的能力是把行业数据、规则和模型结合起来,而不是只会使用通用聊天机器人。
🔗 https://www.ithome.com/0/979/428.htm · IT之家 (ITHome)
工具上新
06Codex Code Review 支持在 AGENTS.md 中配置自定义仓库规则
OpenAI 为 Codex Code Review 增加自定义仓库规则支持:团队可以把编码规范、破坏性变更检查等要求写入 AGENTS.md,代码审查时由 Codex 按相关文件应用规则并在发现中引用对应依据。对打工人而言,把团队经验沉淀成规则文件后,新成员和 AI 都能按同一套标准工作,减少重复口头说明和低级返工。
🔗 https://developers.openai.com/blog/custom-code-review-rules-for-codex · OpenAI Developers
07GitHub Copilot Canvas:开发者与 AI 在共享交互界面中实时协作
GitHub Copilot 推出 canvas extensions,用户可以在 Copilot 应用中通过 `/create-canvas` 创建交互式画布,让 AI 动态更新内容,自己则通过点击和编辑继续操作;官方示例包括 Issue 分流、代码库关系图和工作树管理。对打工人而言,复杂任务不必全部塞进聊天窗口,先把信息做成可视化工作区,更适合协作、检查和持续迭代。
🔗 https://github.blog/ai-and-ml/github-copilot/how-to-build-interactive-experiences-with-canvases · GitHub Blog
08Google 推出 Tunix:基于 JAX 的高吞吐智能体后训练库
Google 发布 Tunix,一个基于 JAX 的智能体后训练库,通过异步 rollout 和生产者—消费者流水线减少多轮工具调用训练中的 TPU 空闲,并提供可插拔训练抽象和性能分析能力。对打工人而言,它更偏开发者基础设施,但意味着企业构建垂直智能体的门槛继续下降,算法、数据工程和业务自动化岗位会更紧密地结合。
🔗 https://developers.googleblog.com/scaling-agentic-rl-high-throughput-agentic-training-with-tunix · Google Developers Blog
09xAI 推出 Grok for Outlook 加载项:总结邮件、起草回复和整理收件箱
xAI 发布 Grok for Outlook,可将 Grok 智能体嵌入 Microsoft 365 邮箱,用于总结长邮件线程、按用户风格起草回复和整理收件箱,面向付费 X 与 SuperGrok 用户开放。对打工人而言,邮件处理可以从“逐封阅读”改成“先让 AI 归纳和分级、自己确认关键决策”,但涉及客户和公司信息时仍需先核对组织的数据合规要求。
🔗 https://x.ai/news/introducing-outlook-addin · xAI News
10英伟达推出 Agent Toolkit,可在桌面工作站快速部署智能体
英伟达推出 Agent Toolkit,目标是在桌面工作站上快速部署 AI 智能体,降低本地试验和原型搭建的成本。对打工人而言,如果工作数据不适合直接上传云端,本地部署工具提供了另一条路径;试用时应优先从脱敏资料和单一流程开始,先验证稳定性再扩大权限。
🔗 https://wallstreetcn.com/articles/3777499 · 华尔街见闻·AI
职场相关
11Karpathy:用语音与 LLM 长谈,可能比反复打字更容易澄清思路
Andrej Karpathy 分享了一种协作方式:打开语音输入,连续进行约 10 分钟的自由表达,即使内容混乱、意识流式也没关系,再让 LLM 重构意图和行动计划。对打工人而言,适合把会议前的头脑风暴、写作卡点和复杂需求先“说出来”,再让 AI 整理成提纲、任务清单或初稿,减少反复修改。
🔗 https://x.com/karpathy/status/2079610838143623371 · X:Andrej Karpathy (@karpathy)
12中国电信 5G 规划大模型试点显示:行业数字员工正在进入生产流程
在现网试点中,中国电信把网络洞察、站点规划、孪生预测和方案生成串成一体,并披露规划效率提升 50%。对打工人而言,行业 AI 的岗位影响通常不是一次性替代,而是先接管取数、比选、预测和报告生成等环节,越早掌握业务流程设计和结果验收,越不容易被动等待岗位变化。
🔗 https://www.ithome.com/0/979/428.htm · IT之家 (ITHome)
13WAIC 观察:AI 更可能先拆解一份工作,再重组岗位分工
虎嗅的 WAIC 观察指出,AI 对工作的影响往往先表现为任务拆分:资料搜集、初稿撰写、数据整理和重复沟通等环节被重新组合,而不是整份职业突然消失。对打工人而言,复盘自己的工作时应列出可标准化、可验证、可交给 AI 的任务,并把时间投入到判断、沟通和最终负责上。
🔗 https://www.huxiu.com/article/4876888.html?f=rss · 虎嗅 (Huxiu)
一句话速览
今天 AI 圈的热点集中在:Gemini 新模型、Hyra 科研智能体、Claude Code 工程自动化、AI 眼镜产业链,以及 Codex 和 Copilot 的工作流升级。
推荐试用
Codex Code Review 自定义规则 — 在仓库的 AGENTS.md 中写下团队规范,让 AI 按项目标准自动审查 PR。
🔗 https://developers.openai.com/blog/custom-code-review-rules-for-codex
GitHub Copilot Canvas — 用交互式画布做 Issue 分流、代码库可视化和工作树管理,适合复杂协作任务。
🔗 https://github.blog/ai-and-ml/github-copilot/how-to-build-interactive-experiences-with-canvases
Grok for Outlook — 自动总结邮件线程和起草回复,适合先从低风险、非敏感邮件试用。
🔗 https://x.ai/news/introducing-outlook-addin
每天3分钟了解AI圈发生了什么
夜雨聆风