夜雨聆风学习资料网

ARTICLE · 1109657

AI工具资讯推荐|20261001期

AI工具资讯推荐|20261001期

打破信息差

2026年9月30日—10月1日全球AI产品重大动态深度解读

摘要

2026年9月30日,AI产业在一日之内迎来多重标志性事件。

OpenAI DevDay 2026发布GPT-6.1 Sol、Dots常驻智能体等20余项更新,将竞争维度从模型能力推向Agent产品化交付;

Google DeepMind同日发布Gemini 4 Argon,以100万Token输出上限和网络安全领域排名第一的基准成绩,开辟模型能力的新战场。

国内方面,智谱上线GLM-5.3-FlashX以200 tokens/s刷新推理速度标杆,

字节跳动完成TRAE、扣子团队并入豆包体系加速"豆包工作"整合,

月之暗面Kimi K3成为首个进入OpenAI企业付费结算体系的中国大模型。

政策层面,特朗普政府与七大科技巨头签署AI自愿安全协议,同日以行政令将"AI"在联邦系统内更名为"超级智能(SI)"。

资本侧,AMD以82亿美元全股票收购World Labs,Anthropic与SpaceX签署最高845亿美元算力协议。

端侧AI迎来硬件拐点——高通第六代骁龙8至尊版支持端侧运行超300亿参数MoE模型,首批搭载终端即日上市。


1. OpenAI DevDay 2026:从模型能力到Agent产品化的全面跃迁

OpenAI DevDay 2026于北京时间9月30日凌晨在旧金山Fort Mason举行,Sam Altman主持并发布超过20项产品与技术更新OpenAI。这场大会的核心信号是:OpenAI正从模型提供商向Agent平台运营商转型,产品矩阵从底层模型延伸至终端用户工作流。

1.1 GPT-6.1 Sol——成本仅为Astra五分之一的"实用旗舰"

核心参数与定价:

指标
GPT-6 Astra
GPT-6.1 Sol
输入定价
$10/百万Token
$2/百万Token
输出定价
$50/百万Token
$10/百万Token
缓存输入
$1/百万Token
$0.10/百万Token
上下文窗口
105万Token
约105万Token
最大输出
—
12.8万Token

GPT-6.1 Sol在DeepSWE v1.1编程测试中匹配Astra水平,OSWorld 2.0测试中与Astra差距仅2.1个百分点valueaddvc.com。这意味着对于大多数企业应用场景,Sol提供了接近旗舰模型90%以上的能力,成本却只有五分之一。

值得关注的是,此前计划发布的GPT-6.1 Astra因安全问题被取消openai.com。这是OpenAI首次在公开场合承认某款模型因安全考量而被搁置,折射出模型能力提升与安全约束之间的张力正在加剧。

趋势判断: GPT-6.1 Sol的发布标志着大模型API市场的竞争焦点从"谁最强"转向"谁的性价比最优"。当顶级模型的替代品以1/5的价格提供接近性能时,企业客户的采购决策将从追逐旗舰转向成本优化,这对所有模型厂商的定价策略构成压力。

1.2 Dots——常驻智能体拥有独立云电脑

Dots是本次DevDay最具产品想象力的发布。它由GPT-6 Astra驱动,拥有独立的云端电脑和浏览器,可连接超过4000款应用,支持7×24小时自主推进工作并主动汇报进度OpenAI。

产品定位分析: Dots不是一个聊天助手的功能升级,而是一个拥有完整执行环境的自主Agent。与此前Meta Muse的独立Linux VM架构思路一致,但通过连接4000+应用的生态规模建立了更广的触达面。首批面向Pro($200/月)、Business Premium用户开放,Enterprise用户需管理员开启OpenAI。

1.3 其他关键发布

  • Ultrafast高速档
    :GPT-6 Astra的高速模式,在Codex中最高提速8倍(约300 tokens/s),API最高提速6倍,仅对Pro 500及企业用户开放OpenAI
  • Decisions API
    :基于GPT-6 Luna模型,限制模型从预定义选项中选择,响应时间约150—230毫秒,适用于内容分类与路由分流OpenAI
  • ChatGPT Space
    :人机协作空间,用户、团队与Agent可在同一页面共享知识库、编辑动态页面OpenAI
  • Codex Cloud
    :支持云端运行大型重构任务,关机后仍可继续执行,集成Security Cloud自动扫描漏洞OpenAI
  • Pro 500订阅
    :每月500美元,含25倍Plus额度及Ultrafast;Pro 200($200/月)重新开放但用量计算方式调整OpenAI
  • Sign in with ChatGPT
    :全球开放,首批16家合作伙伴接入OpenAI

趋势判断: OpenAI的订阅体系正在从"模型访问权"向"Agent工作平台使用权"演变。Pro 500的推出意味着OpenAI开始向高净值专业用户收取"Agent全功能使用费",这一定价逻辑的转变预示着AI服务的ARPU天花板正在被大幅抬高。

2. Google Gemini 4 Argon:网络安全与超长输出的新标杆

Google DeepMind于9月30日发布Gemini 4 Argon,被官方称为公司迄今最先进的AI模型Google DeepMind。

2.1 核心技术参数

指标
数值
单次输出上限
约100万Token
(此前为6.4万)
DeepSWE v1.1(软件工程)
77.9%
(Opus 5.5为74.2%,Astra为74.1%)
Vibe Code Bench
91.9%
CWE-bench v1(网络安全)
68%
(并列第一)
AutomationBench(自动化)
51.3%
(排名第一)
GraphWalks (0–128K)
99.7%
推广期API定价
输入$2/百万Token、输出$10/百万Token
正式定价
输入$4/百万Token、输出$20/百万Token

2.2 发布策略的深意

Gemini 4 Argon的初期发布策略极为特殊——仅通过Fairwind计划向可信网络安全团队及美国政府开放Google DeepMind。

3. 国内AI赛道:整合、提速与国际化突破

3.1 智谱GLM-5.3-FlashX——速度即战略

智谱AI于10月1日正式上线GLM-5.3-FlashX,这是基于GLM-5.3-Flash的优化版本163.com。

核心参数:

  • 架构:稀疏注意力与线性注意力混合架构
  • 总参数320B、激活参数18B
  • 最高输出速度达200 tokens/s
    ,是GLM-5.3-Flash的5倍
  • 1M上下文窗口下维持此速度
  • 支持原生多模态(图片/视频理解)
  • 定价为GLM-5.3的1/10(限时折扣内为1/20)
  • 依托十万张国产芯片集群实现低成本推理163.com

3.3 Kimi K3:中国大模型首次进入OpenAI企业付费体系

美国AI基础设施公司Baseten宣布与OpenAI达成合作,企业用户可通过OpenAI编程工具Codex使用Kimi K3,调用费用可直接计入企业已有的OpenAI采购承诺额度今日头条。

这是中国大模型首次进入OpenAI企业付费结算体系今日头条。Kimi K3是月之暗面开发的大模型,参数规模达2.8万亿,原生支持视觉能力,拥有100万Token上下文窗口凤凰网。Baseten承诺所有模型运行在美国服务器,针对所有提示词实行零数据保留。

3.4 腾讯:元宝个人智能体计划与Hy3/Hy4限免延长

  • 混元Hy3限免及Hy4 preview夜间限免延长至10月31日
    ,10月10日前首次开启Hy4 preview对话的用户享14天免费额度搜狐
  • 元宝计划推出个人智能体
    ,内部权衡两种方案:激进方案是彻底重构元宝为新产品,稳妥方案是保留元宝现有功能矩阵、将个人智能体作为新模块嵌入AIProductHub
  • 腾讯已布下三路兵马:元宝(生活场景)、Handy Bot(微信端服务号+独立App计划)、LightVela(云端Agent托管)AIProductHub

6. 特朗普AI自愿安全协议与"超级智能"行政令

6.1 七大巨头签署自愿安全协议

9月30日,特朗普政府与七大科技公司签署AI自愿安全协议白宫。

签署方: 特朗普(政府方)、桑达尔·皮查伊(Google)、达里奥·阿莫代伊(Anthropic)、马克·扎克伯格(Meta)、格雷格·布罗克曼(OpenAI)、埃隆·马斯克(xAI)、黄仁勋(NVIDIA)白宫。

四层管控架构:

  1. 企业内部安全控制
  2. 内部专属安全团队
  3. 独立外部审计机构
  4. 董事会独立委员会白宫

该协议被定性为具有"道德约束力",要求企业与独立审计机构合作,拟成立10人委员会监督执行白宫。

相关学习资料