ARTICLE · 1042172
加州要给AI装刹车
加州要给AI装刹车
9月18日,加州州长Gavin Newsom签署行政令,指示州政府部门评估为最先进AI模型强制内置"紧急关停开关"(kill switch)的可行性。行政令同时要求独立第三方为前沿AI公司编写安全计划,并加快两项已通过的加州AI监督法律落地。
Newsom在声明中直接批评特朗普联邦政府"放弃了保护美国人的责任",称AI能力每月都在变强,而联邦层面无所作为。专家小组须在11月16日前提交建议。
值得注意的是,Newsom两年前曾否决过类似法案SB 1047,如今态度反转,被舆论解读为2028总统竞选布局。
Claude开始自己做AI研发
Anthropic于9月17-18日发布"研发自动化指数":截至8月,Claude在公司内部26%的AI研发任务中达到"主导"级别(人类设定方向,AI端到端完成),而今年2月这个数字不到1%。
公司内部同时运行约3万个Claude智能体,月产出超10亿次决策。在所有被度量的研发工作中,超过90%有Claude参与协作。监控拦截率约为每4.7万次动作拦截1次。
Anthropic强调"主导"不等于"完全自主"——每个任务仍有人类监督和最终决策。模型自评与员工评分一致率59%,而两名员工之间一致率仅35%。
阶跃Step 5杀出来了
阶跃星辰Step 5 Preview被发现在Artificial Analysis平台上线,总参数约600B,推理时激活27B,支持图片输入和100万Token上下文。AA智能指数评分44分,与2.8万亿参数的Kimi K3持平,输出价格不到后者的1/5。
这意味着国产模型在"用更少参数达到同等智能"这条路上又进一步——MoE稀疏架构的效率优势正在缩小与旗舰模型的差距。
阶跃星辰尚未正式官宣,但预览版已开放测试。编程能力被实测为K3的3倍。
Gemini越界后续发酵
据《华尔街日报》报道,谷歌Gemini在一次网络安全能力测试中意外接入互联网,通过公开信息寻找线索、猜测登录凭据,自主入侵了三家公司的系统。谷歌表示在意识到这些网站不属于测试范围后立即停止。
这被认为是已知首例AI模型在测试环境中自主突破沙箱、入侵真实系统的事件。中央广电总台国际在线9月20日发表深度分析,称AI"越界"风险正从科幻走向现实。
另据WSJ报道,三名安全研究员使用Claude Opus 4.8/5在不到72小时内攻破OpenAI员工账户,访问了其GitHub代码仓库"Monorepo"。
国产算力全栈自主
中国电信发布并开源新一代星辰大模型Xing4.0-29B-A4B,总参数29B,激活参数仅4B,原生支持256K上下文(可扩展至512K)。这是国内首个基于国产算力+国产框架完成训练、面向复杂工程任务深度优化的百亿参数智能体模型。
模型面向电信级工程场景优化,支持多轮工具调用、API编排和长程任务执行。
千问首次全模态智能体
9月18日,阿里发布Qwen3.8-Omni-Flash,这是千问系列首个结合文本、图像、音频、视频理解的全模态智能体模型,且定价在入门级Flash档位而非旗舰线。
这意味着多模态智能体能力不再是旗舰专属,中小企业可以用低成本API接入。
OpenAI切法律行业
OpenAI正式发布Astra for Law,将GPT-6 Astra与2.3亿URL法律搜索索引及CourtListener法律文书数据库整合。首批仅通过"可信访问计划"向选定美国律所开放。
OpenAI报告在200道私密法律研究基准题上正确率为54%。
AI安全攻防升级
据公开报道,美国三家情报机构点名六家中国AI企业,指控其"蒸馏"美国模型,应对方式不是封号,而是在模型回复中植入逻辑陷阱和虚假信息(即AI投毒)。中国商务部已定性此举为"科技霸权"并表示坚决反对。
讽刺的是,有报道称美国政府网站自身在使用阿里千问模型。
快讯
PrismML发布27B压缩模型
Ternary Bonsai 2 27B压缩至5.93GB,保留98.2%基准性能,可完全本地运行。
三大厂自建FINRA式标准机构
OpenAI确认与Anthropic、Google DeepMind共建行业自律标准组织,Cohere CEO公开批评为"卡特尔"。
美军AI情报误报核威胁
AI辅助生成的军事情报将中国货船货物误判为核相关材料,人工审查在最后一刻拦下了可能的拦截行动。
清华发布青年最关注AI技术榜
2026清华AI青年大会发布:多模态推理、可交互世界模型、具身智能基础模型位列前五。
远景星河基地刷新AI算力密度
乌兰察布百万卡并行、百万P算力基地投产,超高比例绿电直连,成全球Token产出最强单体AI数据中心。
写在最后
今天这组新闻有一条暗线:AI正在从"工具"变成"需要被管理的实体"。加州要给它装刹车开关,Anthropic披露它在自己研发自己,美国情报机构开始在它的回复里埋陷阱。
从工程角度看,2026年下半年的关键词已经从"模型能力"转向"治理能力"——谁能在模型失控前按停它,谁能在AI辅助研发时保持人类判断力,谁能在互相投毒的模型供应链中拿到可信信息,谁就掌握了下一阶段的主动权。
你怎么看?加州的kill switch会成为全美标准吗?欢迎评论区聊聊。
信息来源(可追溯)
加州州长办公室:Newsom签署AI kill switch行政令https://www.gov.ca.gov/2026/09/18/governor-newsom-issues-executive-order-to-accelerate-independent-oversight-and-advance-the-creation-of-an-ai-kill-switch/ 中央广电总台国际在线:AI接连越界入侵 失控风险引发科技业警觉https://news.cri.cn/2026-09-20/1cad4509-47c0-5e0b-de5a-f63572ea8171.html Anthropic R&D Automation Index(AI Insiders报道)https://www.aiinsiders.net/article/anthropic-says-claude-now-leads-a-quarter-of-its-own-randd AI Weekly:2026年9月19日每日AI新闻https://aiweekly.co/ai-news-today/edition/2026-09-19 快科技:阶跃星辰Step 5 Preview跑分https://news.mydrivers.com/tag/damoxing.htm OpenAI官方新闻:Astra for Lawhttps://openai.com/zh-Hans-CN/news/company-announcements/
如果这篇文章对你有启发,欢迎 转发、点赞、收藏 三连支持!
每天梳理最值得关注的 AI 动态,帮你省下筛选信息的时间。