ARTICLE · 1102661
OpenAI Sol 6.1改进和AI助手Dots安全性思考
早上看了昨晚OpenAI官网的“devday-2026-recap”新闻稿,这次超过 20 项更新大部分都剧透了。
GPT-6.1 Sol
模型迭代还是有惊喜,性能提升价格进一步下降:GPT-6.1 Sol 仅7天就取代了 GPT-6 Sol。它的智能指数比 GPT-6 Astra 低1分。在最大努力水平下,GPT-6.1 Sol 完成每个智能指数任务的成本不到 GPT-6 Astra 的四分之一(0.72 美元 vs 3.26 美元)。它比GPT-6Sol的每个任务成本低 31%(1.05 美元),比 GPT-5.6 Sol 低 64%(1.99 美元)),GPT-6.1 Sol 定价与 GPT-6 Sol 相同,均为每百万输入/输出令牌 2 美元/10 美元,另外缓存读取折扣从 90% 提高到 95%。
不过GPT-6.1 Sol在所有工作量级别下的输出Tokens数量均比 GPT-6 Sol 多 10-30%。

Terminal-Bench 4.0的分数提升非常明显

Dots
OpenAI近期宣传的“o"也正式官宣是AI助手Dots。Dots基于现有GPT-6版Astra模型运行,拥有独立的云端电脑,能在长期使用中从反馈里学习,并全天候为实现你的目标而工作,主动工作,定位为"始终为你守护的AI助手“。用户可通过发消息或语音通话方式与其交互,未来还将支持短信渠道。----功能和Meta的Muse,SpaceX Grok Bot ,Instinct相关产品高度重叠。
OpenAI预计,随着时间推移,用户最终将能同时管理多个智能体。该公司还透露,面向企业客户的专属Dots正处于测试阶段,应用场景涵盖邮件营销、财务会计及法律分析。

查看了OpenAI官网“introducing-dots“,“how-we-build-safety-security-and-privacy-into-dots” 两篇文章,没有太多细节。
下图是OpenAI Dot的安全架构设计。对比Meta Muse两家骨架类似但肌肉不同,Muse偏"工程围栏",而OpenAI偏向"模型对齐 + 规则围栏"。
Muse的技术文章讲到螺丝钉了,Dot技术文章还停留在原则上。

两者共同的设计原则都是,运行代码的环境"和"执行防护的系统"必须分开。Dot原文是"我们将强制执行自动审核的控制机制置于 Dot 可以修改的环境之外" ;Muse 是 Sentinel 跑在宿主侧、独立于 Agent。设计理念完全一致。
Muse安全部分请参考作者之前文章Muse的安全架构技术维度深度解读
最近Muse也爆出私卖键盘的小故事,这类授权问题,还需要权衡取舍,但相信会越来越好。
补充信息
OpenAI周二披露,ChatGPT每周活跃用户已超过12亿,较今年夏季的10亿进一步提升。这个量级已经和Meta相当。
之前据 Axios 报道,OpenAI 的年化收入运行率接近 700 亿美元,自第三季度开始以来增长超过 70%,最大的增长动力来自企业。目前估值1.4T。
--------------
所有文章会定期整理到合集的相关位置。方便大家通过底部的合集功能,查询相关的文章。 留言外可以通过邮件联系作者Frank622@gmail.com
--------------