ARTICLE · 1144273
GPT-6全量开放:聊天框开始抢软件的活
大家好,我是苍一,一个干了13年的后端开发,正在探索AI编程,从产品到开发的全生命周期最佳实践,如果您感兴趣,欢迎关注👇,看我如何自我革命。
OpenAI又出手了。这次不是小修小补。
GPT-6今天正式向所有ChatGPT用户开放。覆盖范围是每周12亿活跃用户,免费用户也包括在内。
时间点选得很微妙。Anthropic刚发布Haiku 5.5,前后只差几分钟,OpenAI的公告就压了上来。
但真正值得聊的不是发布本身,而是随GPT-6一起上线的一个功能:智能用户界面,官方叫Intelligent UI。
回答不再是文字,是能用的东西
以前我们跟AI对话,本质上就是打字进去,文字出来。
现在不一样了。你在ChatGPT里问一个问题,回答可能直接长出一个按钮、一张图表、一个滑块,甚至一个完整的小程序。
举个例子。
你说:帮我做个周日烤羊腿的计划,朋友要来,但人数还没定。
GPT-6直接给你生成一个迷你应用。界面上有菜单,有食材清单,还有一个可以动态调整人数的调节器。你把人数从4改成8,西兰花从625克变成1250克,苹果从4个变8个,羊腿重量跟着联动。
下面还有一个时间流。周六腌制、周日中午准备、下午入烤箱,每个环节都是可以勾选的进度卡。
你不用再开备忘录,也不用下厨房App。聊天界面本身就是你的专属工具。
再比如你说:拆解一下7速自行车的机械设计。
它会弹出一张多维卡片,车架、轮组、传动、刹车、操控分成五个标签页。点哪个,就展示哪部分的原理,还带可以拖拽的示意图。
分账单也行。拍一张饭局小票发过去,一个带人员筛选和一键复制的分账器当场生成。
算养老金也行。问一句每月定投2000、年化6%、30年后有多少,对话框里直接拉出一个带滑块的计算器,金额和年限随便拖,曲线实时变化。
甚至可以说"给我做个复古像素游戏",对话流里直接渲染出一个能玩的跑酷游戏。
有一句话形容得很准:你伸手要什么工具,它现场给你捏一个。
这和以前的代码沙盒不是一回事
看到这里,熟悉AI产品的人会说:这不算新东西,Artifacts早就能跑HTML了。
区别在底层。
以前的代码生成,是模型在后台写完一整段HTML和JS,扔进一个隔离环境里冷启动运行。加载慢,界面割裂,手机上体验更差。
GPT-6走的是另一条路。OpenAI在客户端预埋了一套原生渲染的交互组件库,按钮、表单、滑块、图表全部高度封装,遵循统一的设计规范。
更关键的是流式编译。模型一边吐字,编译器一边处理界面。你不用等整段代码生成完再等加载,组件是逐帧长出来的,视觉上就是界面在丝滑地铺展。
OpenAI还在训练阶段专门加入了UI和UX的对齐。模型会自己判断:这个布局清不清晰,这个按钮放这里好不好点。
也就是说,它不只写代码,还在做产品经理的活。
另外它不逞强。当一句话就是最好的回答时,它依然只输出纯文本。
速度也变了:边想边答
用过大模型深度推理的人都有个体会:聪明是聪明,就是转圈太久,动不动等半分钟。
GPT-6改了这一点。它学会了在推理没结束的时候,先把阶段性的答案框架说出来,然后再补全深层内容。
数据上,GPT-6最高推理档位的首字输出速度,追平了上一代的中等档位,同时最终得分还超过了上一代满血版。
联网搜索快了近一半。需要实时检索的场景下,平均提前44%开始输出回答。
50年软件史的拐点
如果只把这理解为"界面变好看了",那就低估了这件事。
OpenAI在公告最后写了一段话,大意是:几十年来,人类一直在适应软件,在为特定任务设计的固定界面里来回折腾。未来会反过来——软件适应人。你只需说出想完成什么,专属的交互体验就围绕这件事自己长出来。
回头看这段历史很清楚。
50年前是命令行。人得像机器一样记指令。
30年前是图形界面。窗口和鼠标让人开始通过固定按钮用软件。
15年前是移动互联网。一切被封进App图标里,你想订票,得先学会订票软件的逻辑;你想记账,得先搞懂记账软件的分类。
今天,固定界面这个东西,开始被拆掉了。
对开发者来说,这轮冲击比想象中大。当一个聊天框能现场捏出分账器、计算器、进度管理工具时,大量轻量级工具软件的存在意义就成了问题。
软件从耐用品,变成了一次性用品。
用完即走,下次再要,再长一个出来。
ima 知识库,有需要的朋友,在公众号菜单中获取。