乐于分享
好东西不私藏

AI前沿速报|Claude Code会话互通,Astra发布放慢

AI前沿速报|Claude Code会话互通,Astra发布放慢
AI NEWS2026.08.08

Claude Code 开始在会话之间转交任务,Cloudflare 把 Agent 浏览器放进云端隔离环境。OpenAI 为 Astra 增加网络安全控制,Google 把气旋预报时间再往前推了一天。

今日导读

1、Claude Code 会话可以互相转交任务

2、千问上线定时任务、办公助理和语音通话

3、Cloudflare 推出 Agent 专用浏览器 Kitesurf

4、LangChain 开放 Managed Deep Agents 测试

5、腾讯混元开源算子接入 SGLang

6、Suno 手机端支持录音生成歌曲

1、Claude Code 会话可以互相转交任务

来源图:Claude Devs 帖子原图

Claude Code 新增会话互发消息。用户可让一个会话把任务摘要发给另一个会话,接收方会在执行过程中看到摘要;系统不会发送完整聊天记录或本地文件。

并行开多个会话时,团队少了一轮手工复制背景。摘要会丢掉细节,跨会话交接仍要写清目标、文件范围和验收条件,敏感信息也要单独检查。

来源:X:Claude Devs (@ClaudeDevs)|https://x.com/ClaudeDevs/status/2085817074816070014

2、千问上线定时任务、办公助理和语音通话

主题图:根据该条新闻主题绘制

千问新增思考研究、定时任务、办公助理和语音通话,并接入 Qwen3.8-MAX。办公助理可连接日历、备忘录与浏览器,直接生成 Office 文档;智能体广场首批覆盖物流、房产等领域。

阿里把模型能力接到电脑和日程后,千问开始和办公软件抢入口。企业试用时要检查浏览器操作是否可审计,定时任务出错后能否暂停,以及文档中的数据从哪里来。

来源:公众号:千问APP(阿里)|https://mp.weixin.qq.com/s?__biz=MzYzNDE5MDEwMQ%3D%3D&mid=2247488266&idx=1&sn=3a1988ba0710abcefba9c9dd282b464e

3、Cloudflare 推出 Agent 专用浏览器 Kitesurf

来源图:项目页面题图

Cloudflare 发布 Kitesurf,一款为 Agent 设计的浏览器。它运行在 Workers 的 V8 隔离环境中,现已通过 Browser Run 开放测试,开发者可以让 Agent 在云端执行网页任务。

把浏览器放进隔离环境,部署和扩缩容会更省事。投入正式使用前要测试登录态、验证码、网页变更和失败重试,尤其要限制 Agent 能访问的域名与账号权限。

来源:Hacker News 热门(buzzing.cc 中文翻译)|https://blog.cloudflare.com/kitesurf

4、LangChain 开放 Managed Deep Agents 测试

来源图:LangChain 文章题图

LangChain 的 Managed Deep Agents 进入公开测试。开发者可把 Deep Agents 部署到 LangSmith 托管环境,使用持久执行、记忆、沙箱、通道和评估等能力。

托管服务省下运行时维护,但团队会更依赖 LangSmith 的日志、存储和计费。迁移生产任务前,应先测长任务中断恢复、记忆隔离和沙箱边界。

来源:LangChain:Blog(RSS)|https://www.langchain.com/blog/managed-deep-agents-is-now-in-public-beta

5、腾讯混元开源算子接入 SGLang

来源图:LMSYS 文章题图

腾讯混元开源算子库 HPC-Ops 已合入 SGLang 主分支。公开测试显示,Dynamic Attention 与 Fused MoE 在 Hy3 模型上最高可把每个输出 token 的耗时降低 48.8%。

这类优化直接影响推理吞吐和显卡账单,但 48.8% 来自特定模型与配置。部署团队要用自己的序列长度、批量和硬件重跑基准,再决定是否替换现有内核。

来源:LMSYS:Blog(Chatbot Arena 团队)|https://www.lmsys.org/blog/2026-08-07-hpc-ops-sglang

6、Suno 手机端支持录音生成歌曲

来源图:Suno 帖子原图

Suno 在 iOS 和 Android 应用上线 Voices。用户可在创作界面录制至少一分钟的人声,再把声音用于歌曲生成;Pro 和 Premier 用户可不限量使用,免费用户有体验额度。

手机录音让声音生成更容易,也把授权问题推到用户面前。产品团队若接入类似能力,应保留录音同意记录,并对冒用他人声音和未成年人声音设置额外限制。

来源:X:Suno (@suno)|https://x.com/suno/status/2085731234970227145

7、OpenAI 将 Astra 列为关键网络安全模型

来源图:OpenAI 帖子原图

OpenAI 按准备框架把 Astra 列为首个网络安全风险达到“关键”级别的模型,并为测试环境、网络与工具访问、模型权重和使用监控增加控制。相关报道显示,团队因此放慢公开发布节奏。

Astra 的编程能力越强,自动找漏洞和执行攻击的门槛越低。开发者拿到此类模型后,不能只靠提示词约束;权限分层、网络隔离、操作审计和人工批准都要落到系统里。

来源:X:OpenAI (@OpenAI)|https://x.com/OpenAI/status/2085801349866729975|https://www.ithome.com/0/987/221.htm

8、ChatGPT 全球用户超过 10 亿

主题图:根据该条新闻主题绘制

OpenAI 报告称 ChatGPT 全球用户已超过 10 亿。工作场景里,用户完成任务或创建内容的概率是非工作场景的两倍以上;35 岁及以上用户的消息份额比一年前增加 5 个百分点。

用户增长已经从年轻尝鲜人群扩到更广年龄层。做 ChatGPT 插件、教育和企业服务的团队,应少假设用户熟悉提示词,多提供明确入口、可撤销操作和结果来源。

来源:IT之家(RSS)|https://www.ithome.com/0/986/957.htm

9、Google AI 把飓风预报提前 24 小时

主题图:根据该条新闻主题绘制

Google DeepMind 与合作机构发布 WeatherNext Cyclones。模型在气旋路径、强度和风场结构预测上提高精度,并把有效预报时间从两天延长到三天,平均多出 24 小时。

多一天预警能给疏散、港口和保险调度留出空间。气象产品仍要把模型预测和官方预警分开,极端天气里的漏报成本远高于普通应用。

来源:IT之家(RSS)|https://www.ithome.com/0/986/951.htm

10、Claude Fable 5 生物问题误报减少约 85%

主题图:根据该条新闻主题绘制

Anthropic 调整 Claude Fable 5 的生物安全防护,使普通健康和教育问题触发回退的次数减少约 85%。涉及双重用途病毒学、毒理学和分子设计的请求仍会转交给限制更严的模型。

安全拦截过严会让专业用户离开,放得太宽又可能帮助高风险实验。Anthropic 选择按任务风险分流,做医疗和科研助手的团队可以参考,但还需要领域专家复核边界案例。

来源:Anthropic:Newsroom(网页)|https://www.anthropic.com/news/improving-fable-5-s-biology-safeguards

11、AI 设计出 16 种可杀菌的新病毒

来源图:The Decoder 文章题图

斯坦福与 Arc Institute 团队用 Evo 从零设计完整病毒基因组。模型给出 70 万个候选,研究人员合成其中 285 个,最终有 16 个能复制并杀死细菌;研究已通过同行评审。

AI 已经能把生物设计推进到湿实验验证。它可能帮助开发噬菌体疗法,也会放大生物安全压力。实验室需要把训练数据、序列筛选和合成权限放在同一套审查流程里。

来源:The Decoder:AI News(RSS)|https://the-decoder.com/stanford-and-arc-institute-scientists-used-ai-to-design-new-viruses-that-killed-bacteria-in-the-lab

12、CULTURE-MT 评测社媒翻译能否传递文化语境

主题图:根据该条新闻主题绘制

小红书、浙江大学和复旦大学提出 CULTURE-MT,用中英社媒内容测试翻译是否保留文化符号与情感。团队还发布自动评估模型 JUDGER,报告准确率为 86.03%。

社媒翻译不能只看字面准确。出海产品若忽略梗、语气和社区习惯,译文会像说明书。这个基准适合做离线测试,但上线内容仍要抽样交给母语用户审核。

来源:公众号:小红书技术(dots.llm)|https://mp.weixin.qq.com/s?__biz=Mzg4OTc2MzczNg%3D%3D&mid=2247496008&idx=1&sn=08f2ce717483f63bc00a2181e59e3f40

能执行,也要能收手

从会话转交、浏览器执行到生物设计,AI 能做的动作更多了。团队接入时要把权限、日志、失败恢复和人工批准放进产品设计,不能等事故发生后再补。