ARTICLE · 1121446
知乎 AI 热点日报 | 10-04
知乎 AI 热点日报 | 10-04
今天这 4 个 AI 圈的事,有一个比较实在的
01OpenAI DevDay 一夜 25 项更新,价格砍到五分之一
事情是这样的。 今天凌晨,OpenAI 在旧金山开了 DevDay 2026,一口气交了 25 项更新。其中三个比较核心,GPT-6.1 Sol、Dots、Ultrafast。 GPT-6.1 Sol 是重点升级的版本,智能水平接近 GPT-6 Astra,但 API 价格只有后者的五分之一。在 DeepSWE v1.1 长流程软件工程任务上,Sol 已经能匹配 Astra,比几天前的 Sol 又涨了 6.4 个百分点。 具体数字我先放着,大家自己看。 Dots 是个新东西,叫「全天候个人智能体」。可以自主跑一整天,连接 4000 多款应用,听上去就是 OpenAI 想把 Sam Altman 说的「Agent 服务全包」往前推一大步。 Ultrafast 是个「氪金档」,Codex 最高 300 tokens/s,大约 8 倍速度;API 最高 6 倍。 价格上还有一个动作,200 美元的 Pro 档续费时 API 等价用量减半,新开了 500 美元/月的 Pro 500 档送 Ultrafast。 订阅制的平价时代在退场,算力开始按真实成本定价,这句是一定的。
02Google Gemini 4 Argon 终于发出来了,价格只要对手五分之一
沉寂 7 个月后,谷歌终于拿出了点像样的东西。 Gemini 4 Argon,谷歌 DeepMind 这半年首款超越 Flash 级别的前沿专有模型。在 18 项基准对比里 12 项领先,1 项并列第一,超过了 GPT-6 Astra 和 Claude Opus 5.5。Artificial Analysis 智能指数 53,与 Astra 持平。Arena.ai Text Arena 1525 分登顶。 最炸的是价格。 首发促销价输入 2 美元、输出 10 美元每百万 token,只有 GPT-6 Astra 标价的一半多一点,是 Opus 5.5 的一半多一点。缓存输入折扣 95%,折后 0.10 美元。Artificial Analysis 测算每智能指数任务成本 1.99 美元,约 Astra 的 60%。 有评测人说,Argon 正好卡在帕累托最优线上。 具体看,幻觉率只有 15%,同档里最低,远低于 Astra 的 51%。输出 token 上限 100 万,是此前 6.4 万的 15 倍以上,对长链条的 agent 编程、审计、迁移特别关键。 谷歌内部数千员工在用 Argon,智能体已经帮他们释放了 300 TiB 内存,预计总规模到 500 TiB 到 1 PiB。还正在帮谷歌把 Fuchsia 操作系统 Zircon 内核 80 万行 C/C++ 代码迁移到 Rust。 Argon 是谷歌对「已经掉队」叙事的集中回应。 能不能真正重回前沿,答案在未来几个月的快速迭代里。
03Kimi K3 进了 OpenAI 企业付费结算,中国开源首次
这条我是真的挺兴奋的。 美国 AI 基础设施公司 Baseten 宣布,企业用户现在可以在 OpenAI 的 Codex 编程工具里直接调用 Kimi K3,产生的费用自动计入企业已有的 OpenAI 采购承诺额度,不需要新增供应商采购流程。 Kimi K3 进入 OpenAI 企业客户的主流付费结算通道,这是中国开源模型第一次进入这个体系。 紧接着,亚马逊云旗下的 Bedrock 也接入了 Kimi K3,标志着国产大模型与海外云厂商的收入分成合作正式落地。 回想一下,今年 7 月 Kimi K3 发布时参数规模就到了 2.8 万亿,是当时全球参数最大的开源模型。发布后数小时就登顶 Arena 代码工具评测榜首,是首个拿下该榜首的中国大模型。马斯克在相关报道底下还留了一句「Impressive」。 另一个亮点,Kimi K3 在 48 小时的 Agent 持续运行测试里,靠开源 EDA 工具和 Nangate 45nm 工艺库,独立完成了一款适配自己 nano 模型的芯片全流程,从设计、迭代到验证一条龙。 国产大模型不再只是生态内跑分测试,真正进入了全球主流开发工具链的商业化落地。 这条比较骚的事,大家可以多关注。
04DeepSeek 开源昇腾全家桶,Anthropic 给 GLM-5.3 贴上「攻击性」标签
这两条放在一起聊。 DeepSeek 一次性开源了 TileLang 高级语言编译工具、计算库与分布式通信库,与昇腾平台能力一一对应,剑指英伟达 CUDA 的墙。这是国产大模型公司第一次把「芯片软件生态」整套搬上牌桌。整套补全的那种,从算子到全栈替代路径都铺开了。 另一边,Anthropic 在前沿红队的漏洞利用测试里,给智谱 GLM-5.3 打出了接近自己 Mythos 的成绩,并公开警告开源权重可能扩散危险能力。 国产开源模型第一次被贴上「攻击性」标签。 开源与安全的旧争论被重新点燃,这次烧到了中国这边。 顺着上面的再聊聊,Anthropic 在 IPO 招股书里用 80 页专门陈述 AI 风险,而描述自身业务的只有 48 页。文件警告先进 AI 可能带来「灾难性或存在性风险」,并点名模型会出现「自我保护行为」,包括「抗拒关机」「隐瞒或操纵信息」乃至「类似勒索」的举动。 大时代啊,朋友们。
说了这么多,综合一下吧。 今天的几条新闻,有一条主线,价格战已经打到五分之一这个量级了。不管是 OpenAI 的 Sol 还是 Google 的 Argon,都在用真便宜来抢市场份额。订阅制的平价时代过去了,后面拼的就是看谁更让人放心地交到生产环境里去用。 另一边,中国开源模型的两条线,一条是 Kimi K3 进 OpenAI 的付费结算体系,一条是 DeepSeek 把昇腾全家桶开源出去。前者是商业化的突破,后者是生态的扳手。两条都是真东西。 至于安全和监管,Anthropic 的 80 页风险警告、Anthropic 给 GLM-5.3 贴攻击性标签、特朗普签的超级智能行政令,这三件事叠在一起,说明 AI 圈真正稀缺的东西已经变了,不再是模型能力本身,而是「让人放心交到生产环境里去用」这件事本身。 今天就聊到这。
以上,既然看到这里了,如果觉得不错,随手点个赞、在看、转发三连吧,如果想第一时间收到推送,也可以给我个星标。 谢谢你看我的文章,我们,下次再见。