ARTICLE · 1095936
AI 今日简报 - 2026年9月29日
发布时间:2026-09-29 09:08:55 最近访问:2026-09-29 09:08:55
AI 今日简报 - 2026年9月29日
AI Daily Brief
2026年9月29日 · 周二
AMD拟以82亿美元收购World Labs,布局世界模型与空间智能; Claude Sonnet 5.5发布并进入Claude.ai免费层及Cursor; 佛罗里达州寻求针对OpenAI的紧急禁令并呼吁暂停ChatGPT开发
Today's Highlights
| 1 | AMD拟82亿美元收购World Labs,布局空间智能 |
| 2 | Anthropic发布Claude Sonnet 5.5,免费层与Cursor同步接入 |
| 3 | 佛罗里达寻求针对OpenAI的禁令,呼吁暂停ChatGPT开发 |
| 5 | GPT-6 Luna在Agent Arena排第23,任务成本中位数0.05美元 |
| 6 | 伯克利研究发现智能体Harness对成本的影响大于准确率 |
| 7 | Manus Studio推出Alchemy模式,单提示完成视频制作 |
| 8 | K3-Node发布,兼容PyG API并支持三种训练后端 |
| 9 | 统计称数据中心暂停令仅影响约6000个项目中的3个 |
| 10 | Claude Code加入评测构建与迭代优化能力 |
| 1 | AMD拟82亿美元收购World Labs,布局空间智能 |
| 并购世界模型具身智能 |
| AMD拟以82亿美元收购李飞飞创办的World Labs,以补齐世界模型与空间智能软件能力,并获得可用于机器人训练的合成数据技术。交易被视为其对抗英伟达软硬件生态优势的重要布局,覆盖世界模型、空间智能与具身智能。现有材料未披露交易完成时间、监管审批、支付方式、团队安排或产品整合计划,且信息来自行业转述而非AMD官方公告,关键条款仍待正式文件确认。 |
|
| 2 | Anthropic发布Claude Sonnet 5.5,免费层与Cursor同步接入 |
| 模型发布大语言模型AI编程 |
| Anthropic发布Claude Sonnet 5.5,并提供开发者指南,涵盖与Opus 5.5的模型取舍、从Sonnet 5迁移及Claude Code集成。该模型已成为Claude.ai免费层的默认模型,非付费用户可以直接使用;Cursor也已完成接入,并称其在多类任务上表现可与Opus相当。相关材料还建议在复杂工作流中用其平衡智能水平与Token成本,但尚未提供API价格、统一基准分数或详细限额。 |
|
| 3 | 佛罗里达寻求针对OpenAI的禁令,呼吁暂停ChatGPT开发 |
| AI监管AI安全OpenAI |
| 佛罗里达州寻求针对OpenAI的紧急禁令,并成为首个呼吁暂停ChatGPT开发的美国州,理由涉及已报道的数万起AI安全事件。相关主张要求外部监管立即介入,而非等待企业通过软件工具自行修复风险,并将联网通用智能体对关键基础设施的潜在影响列为核心担忧。现有材料主要来自评论者Gary Marcus的报道与解读,尚未提供法院文件、具体案号、禁令范围或司法裁定结果。 |
|
| 4 | 英伟达推出智能体安全平台,以确定性代码限制权限 |
| AI安全智能体沙箱 |
| 英伟达推出面向AI智能体的安全平台,OpenWorker与其OpenShell工具集成,通过确定性代码执行权限限制,而不是依赖模型提示词进行自我约束。方案默认仅向智能体开放任务所需文件,并阻断密钥、浏览器登录等敏感资源,以缩小提示注入和越权访问的攻击面。业界讨论将其定位为智能体执行层的「信任层」,但现有材料未给出性能指标、支持环境、开源许可或大规模部署验证结果。 |
|
| 5 | GPT-6 Luna在Agent Arena排第23,任务成本中位数0.05美元 |
| 模型评测智能体推理成本 |
| Agent Arena公布GPT-6 Luna Max评测结果:模型排名第23,任务成本中位数为0.05美元,较GPT-6 Sol Max的0.82美元低94%,较GPT-6 Astra Max的2.59美元低98%。其表现接近排名第22的GPT-5.5,但成本低91%;相较GPT-5.6 Luna,「确认成功」与Bash恢复指标也有进步。该评测覆盖需要调用网页、文件系统和终端工具的真实长周期任务。 |
|
| 6 | 伯克利研究发现智能体Harness对成本的影响大于准确率 |
| 智能体AI评测推理成本 |
| 加州大学伯克利分校Sky Computing Lab对Claude Code、Codex与Pi进行比较,指出围绕模型的智能体执行框架会形成明显的「Harness Tax」。研究结论是,切换harness对任务成本的影响大于对成功率的影响,意味着同一模型的预算与性能不能脱离工具调用、上下文管理及执行基础设施评估。现有摘要未披露具体成本差、成功率、样本规模或完整论文链接,结论仍需结合原始实验设计审视。 |
|
| 7 | Manus Studio推出Alchemy模式,单提示完成视频制作 |
| 视频生成AI产品智能体 |
| Manus在Studio中推出Alchemy模式,可从单条提示生成完整视频,并自动承担导演、脚本、分镜、剪辑及音乐节奏配合等环节,目标是将多步骤制作压缩为一次交互。官方同步展示专业B-roll、新闻改编短视频、两分钟人类演化叙事和90秒大模型历史视频等案例。材料未说明该功能的开放范围、订阅价格、生成时长、分辨率、版权政策或底层模型,当前信息主要反映产品能力演示。 |
|
| 8 | K3-Node发布,兼容PyG API并支持三种训练后端 |
| 开源工具图神经网络机器学习 |
| François Chollet介绍K3-Node,一款基于Keras 3构建的图神经网络库,支持JAX、PyTorch和TensorFlow多后端运行及相应硬件加速。项目宣称实现PyG公开API的100%兼容,并吸收Spektral与StellarGraph中的基础模型和先进架构,便于既有图学习代码迁移至Keras生态。现有材料未提供代码仓库、许可证、性能基准或正式版本号,实际兼容性与训练效率仍需开发者验证。 |
|
| 9 | 统计称数据中心暂停令仅影响约6000个项目中的3个 |
| AI基础设施数据中心行业数据 |
| SemiAnalysis披露的项目统计显示,针对AI数据中心建设的暂停令仅影响约6000个项目中的3个,意味着在该统计口径下,政策性暂停尚未成为大多数项目的主要约束。该数字为判断算力基础设施扩张与地方监管的实际影响提供了量化参照,也显示公开争议与项目层面的直接阻断之间存在差距。现有材料未说明项目所在地区、统计周期、装机规模、受影响容量或「影响」的具体定义,且链接属于二次转述。 |
|
| 10 | Claude Code加入评测构建与迭代优化能力 |
| AI编程模型评测开发工具 |
| Anthropic为Claude Code加入评测构建与「hillclimbing」迭代优化能力:开发者可让Claude协助设计和实现评测框架,再依据评测结果持续调整提示词或系统配置。该更新把应用质量测量与优化循环直接纳入编码智能体工作流,有助于减少仅凭主观体验调参的过程。现有公告未披露支持的评测类型、自动化程度、版本要求、收费方式或效果提升数据,具体可用范围仍需以Claude开发者文档为准。 |
AI Daily Brief
最新、最快、最有价值的 AI 资讯每天只需几分钟,紧跟全球智能浪潮
AIDailyBrief.cn
点击下方查看原文,获取更多 AI 资讯