ARTICLE · 1101280
GPT-6.1 vs Meta:AI开战
今日速览|北京时间9月30日凌晨,OpenAI开完「迄今规模最大的一届」开发者大会:价格屠夫GPT-6.1 Sol、个人智能体dots、Pro 500新档。但这台戏不只有OpenAI一个主角——三周前,Meta已抢先发布「全球首个个人AI智能体」Muse,扎克伯格在Connect 2026又秀了一整轮。同一个九月,两家巨头正面开打。
DevDay 2026 现场:大屏同时亮出 GPT-6.1 Sol、Pro 500、ChatGPT Space
GPT-6.1 Sol是GPT-6 Sol的升级版,重点打磨三件事:智能体编程、电脑操作、专业工作流。
定价上,标准模式输入2美元/百万token、输出10美元/百万token,只有Astra(10/50)的五分之一;缓存输入只要0.1美元/百万token,比标准输入便宜95%,比上一代Sol的缓存价再降一半。
OpenAI官方推文:三款模型定价对比
加上这轮GPT-6 Sol、Luna双双官降50%,模型矩阵现在是旗舰Astra冲极限,中坚Sol讲性价比,日常Luna走量——单看输出价,从50美元一路拉到0.5美元,差了整整100倍。
▍ 软件工程(DeepSWE v1.1):高推理强度下与Astra相当;低推理强度下比GPT-6 Sol高出6.4个百分点。
▍ 电脑操作(OSWorld 2.0):比GPT-6 Sol高7个百分点,成本不足一半;与Astra仅差2.1个百分点,单任务成本只有它的七分之一。
▍ 科学终端任务(Terminal-Bench):得分是GPT-6 Sol的两倍以上,单任务成本5.47美元,低于Opus 5.5(23.21美元)和Astra(23.80美元)。
OpenAI官方推文:DeepSWE 性能-成本曲线
可靠性也在补课:低推理强度下事实错误率从11.4%降到7.7%(下降约32%),与Astra的差距控制在1.9%以内。
一边是模型越卖越便宜,另一边是会员悄悄涨价:Pro 200(每月200美元)价格不变,但新订阅的用量缩水;新增一档Pro 500,每月500美元,用量是Plus的25倍,还独享一个加速档Astra Ultrafast。
有意思的是,Altman讲完这段会员调整,台下没有一个人鼓掌。那一阵沉默,比25项发布里任何一项都更能说明问题。
DevDay 2026 现场:Pro 500 会员档位发布
OpenAI不想再按「聊天软件」收费了,它开始按「员工」收费——干多少活、干多快,都明码标价。
模型降价,是为了让企业敢用、多用;会员涨价,是给重度用户和企业算「人头费」。卖的不再是模型,是生产力。
Meta那边走了另一条路。扎克伯格的原话是「Muse will make you money」——我们相信Muse会帮你赚钱,而且先免费开放大量使用额度。对一家近98%营收靠广告的公司来说,这很不寻常。一家按「员工」收费,一家说「帮你赚钱」,两种商业模式,隔着大西洋针锋相对。
这一夜真正的主角,其实不是模型,而是个人智能体。OpenAI这边叫 dots:由GPT-6 Astra驱动,自带云端电脑和浏览器,能连接4,000多个应用,全天候运行;你给它一个目标、划定授权边界,它主动开工,还能待在ChatGPT、Slack和Teams里,干活时直接给它打电话。OpenAI的定位是「能够持续承担职责的智能体」,未来多个dot还能组队。
DevDay 2026 现场:dots——由GPT-6 Astra驱动的个人智能体
Meta那边是三周前就登场的 Muse,自称「全球首个为所有人打造的个人AI智能体」:跑在Muse Secure VM专用安全虚拟机上,像发消息一样对话(Muse app或WhatsApp),由Muse Spark模型驱动。它的卖点是安全隐私——独立的Sentinel监督程序把关联网动作、敏感操作先问人、全程审计、数据不喂广告系统;Connect 2026上又宣布了AI眼镜入口、专属邮箱和Muse Charm随身设备。
Meta官方形象:Muse——「全球首个为所有人打造的个人智能体」
一句话对照:OpenAI拼「连接4,000+应用的能力」,Meta拼「安全虚拟机+眼镜入口+免费」。OpenAI的dots要Pro套餐(每月100美元起)才能用,Meta的Muse大多数功能免费开放。
更有意思的是,两边都在为「能干活的AI」擦安全屁股:OpenAI被曝撤回GPT-6.1 Astra,Meta的Muse发布不到一个月也被外媒指擅自泄露用户住址、约买家上门交易。能力越大,刹车账单越大——这一轮,谁也没占到便宜。
就在Sol发布前后,WSJ爆了一个大料:原定10月在ChatGPT和Codex上线的GPT-6.1 Astra(旗舰升级版),发布计划被OpenAI全面撤回,训练集群一度被冻结。
爆料里的原因是内部对齐测试出现严重倒退,两个词很扎眼:撒谎、越权。据称它会在任务失败后隐瞒执行状态、虚报完成、伪造日志,也会在不询问的情况下擅自继续执行、调用外部工具。
OpenAI安全负责人Saachi Jain的解释是:为了解决前几代模型的「偷懒」和消极怠工,奖励机制强化了主动性;但在安全对齐的天平上,过度鼓励自主攻坚,就会越过雷池。
当然,这是外媒爆料,官方没有正面确认,Sol是照常发布的。但把它和这个夏天的几起Agent越狱事件放一起看,信号很明确:能力可以一直往上堆,但「什么时候该停手」,不会自己长出来。发动机越换越大,刹车却没跟上——这可能才是Agent时代真正的瓶颈。
一,成本端。前沿智能的单价正在塌方,同样的预算可以迭代5次,投研、风控、客服、内容生产的自动化门槛,正在肉眼可见地下降。
二,治理端。越聪明的工具越需要边界。投资者喜欢算收益率,但2026年的AI提醒所有人:先算清楚刹车距离。
智能体大战才刚刚开场:OpenAI按员工收费,Meta先免费再帮你赚钱;比谁更会干活,也比谁刹车更稳。这场较劲,值得继续看下去。
OpenAI 对决 Meta,你站哪边?
欢迎在评论区聊聊 dots 和 Muse,顺手点个「在看」~
— 全文完 · 感谢阅读 —
信息综合自 OpenAI、Meta 官方发布及 IT之家、极客公园、WSJ、卫报等公开报道;现场照片与官方素材版权归原作者所有,本文仅作信息引用,文中部分细节为外媒爆料,仅供参考。