ARTICLE · 1058886
未来的软件长什么样?Solaris 给出的回答:边看边生成
你手机里的每一个 App,都是人一行一行写代码造出来的。点哪个按钮有反应,点完跳转到哪一页,购物车里怎么算钱,这些规则写进程序里,软件才能"动"起来。这是过去几十年不变的规矩。
2026 年 8 月底,一家叫 Runway 的 AI 公司抛出了一个想改变这条规矩的东西。它叫 Solaris,一个研究项目,官方给它的定义是"界面世界模型",英文 Interface World Model,号称是业内第一个。它的核心主张翻译成大白话就是:界面不用写,让它像视频一样"长"出来。
界面,可以像视频一样生成
先说 Solaris 到底怎么工作。
一般我们用 AI 生成图片,生成的是一张静止图。生成视频,生成的是一段按时间顺序播完就结束的画面。Solaris 的想法是,把软件界面也当成"视频"来处理,只不过这个视频没有写好的剧本,播放到哪一步,由你的操作决定。
你在界面上点一下、拖一下,或者输入一句话,模型读取当前画面和你这个动作,接着生成下一帧。这一帧里,按钮该变成什么状态,物体该挪到哪,页面该跳出什么内容,都由模型实时算出来。整段对话,模型不需要提前知道你要做什么,也不需要任何代码告诉它"点这个按钮应该发生什么"。
Runway 放出的演示里,有一个虚拟服装店。整个店面本身就是界面,你伸手从衣架上拿起一件衣服,拖到自己身上就能试穿;你觉得店里的陈设碍事,可以直接移动它。这些交互不是开发者预先写好的功能清单,而是模型根据画面和动作现场"演"出来的。
用 Runway 自己的话说:你眼前看到的画面,本身就可以成为软件。
为什么要绕开代码
可能有人会问,现在的软件不是好好的吗?为什么要费劲搞这一套?
Runway 给的理由是:把画面翻译成代码,本身就是一种信息损失。
当一个设计师画出一张精致的界面图,里面藏着材质、光影、空间关系,还有各种微妙的物体状态。可一旦这张图被改写成 HTML、CSS、JavaScript,程序里保留下来的,只有开发者当初决定要实现的那部分行为。软件最终能发生什么,在上线之前就基本焊死了。你只能在别人预先留好的按钮之间选择,无法超出他们的想象。
Solaris 想换一条路:不先把画面翻译成代码,再让代码驱动画面,而是让模型直接在视觉空间里理解界面、生成交互。网页和 App 的边界因此变得模糊。传统开发里"这个区域可点击、那个物体可拖拽、拖过去触发什么"的层层规定,在 Solaris 的世界里都不存在了,一切变化由模型看着当前画面现编。
注意,这不止是把"开发"变得更省事。它想改变的是软件的本质定义:软件不再是一个写好的程序,而是一场由你和模型共同完成的实时生成。
一步一个脚印:Runway 的来路
Solaris 不是 Runway 心血来潮的产品。回看它的路线,能看出这是一家公司逐步铺开的大棋盘。
Runway 本行是 AI 视频生成,它的 Gen 系列模型在这个领域是第一梯队。2025 年 12 月,它发布了 GWM-1,号称为首个"通用世界模型",能理解物理规律、几何结构、环境动态,逐帧预测世界随时间怎么变。GWM-1 分成三个方向:模拟可探索环境的 GWM-Worlds、服务机器人的 GWM-Robotics、生成交互式数字人的 GWM-Avatars。
到了 2026 年,Runway 的动作明显从"生成内容"转向"生成可交互的世界":先有实时角色 Characters,后有可交互世界 GWM Worlds,再到这次直接生成交互界面的 Solaris。在 AI 行业里,它们被归到一个正在成形的大类,叫"实时交互模型":不只是生成一段给你看的视频,而是生成一个能和你一来一回的活世界。
一个正在起风的赛道
Solaris 发布的时间点,也很有意思。
2026 年 7 月的世界人工智能大会上,昆仑万维的 CEO 方汉高调宣布"2026 年是世界模型元年",认为 AI 的核心命题正在从"生成文字、图像、视频"转向"理解和交互"。不管这个说法有没有争议,行业确实在往这个方向挤:Google DeepMind 有 Genie,英伟达有 Cosmos,国内的 Vidu 把实时生成单独命名为 S 系列,还有一堆创业公司在跟进。
另一个相关概念也在同期升温:Computer Use,也就是让 AI 看着屏幕、操作鼠标键盘,替人把电脑上的活干完。这样的 AI 需要"看懂"界面,而 Solaris 主张的"界面即视频",本质上也在回答同一个问题:界面到底是什么,机器该怎么理解它。一边是 AI 学着用人类的界面,一边是界面学着按 AI 的方式生成,两条线迟早要撞在一起。
先别急着乐观
当然,Solaris 目前还只是一个研究项目,不是能马上装进手机的成品。Runway 在 9 月中旬放出一段概念视频,配文是"让互联网变得可玩,一个 Solaris 的概念",视频里也没有给出产品路线图或技术白皮书。换句话说,这更多是一次方向宣示,离量产还有距离。
摆在它面前的问题也很多。最大的一个是可控性:模型实时生成的界面,怎么保证永远不出错?万一它生成的按钮点不动,或者页面逻辑前后矛盾,用户该找谁?传统代码之所以存在,正是因为确定性,同样的输入永远得到同样的结果。Solaris 的画面由模型现场发挥,一致性、稳定性、可追溯性都要重新设计。
还有安全。你让模型根据当前画面编下一步,如果场景复杂或者输入被做了手脚,模型会不会生成出越界的内容?开发者失去对行为的完全控制后,出了事故责任怎么划分?这些都是代码时代用不着操心、界面时代必须面对的新问题。
再有就是"人"的问题。如果界面真的不再需要提前写好,网站和 App 的开发流程会怎么变?设计师、前端工程师的职责会被重新定义,测试、审查、合规这些环节也都得换一套打法。技术从来不只是技术,它总在悄悄改写行业的岗位分布。
一个更大的问题
抛开商业和技术的细节,Solaris 真正让人心里一动的地方,其实是它背后那个更朴素的追问:软件一定要被"制作"出来吗?
过去我们默认,想用什么东西,得先有人把它造出来。想要一个能试衣服的商店,得先有程序员写代码、设计师画图、产品经理排需求。Solaris 的设想是,这个"先造后用"的环节可能可以跳过。你开口,画面就出现,你操作,画面就回应。软件从一件被交付的物品,变成一场被共同完成的演出。
这个转变如果成真,改变的不只是开发者的工作,还有普通人对软件的想象:原来界面不是一堵砌好的墙,而是一条一直在流动的河。
当然,这些还只是想象。Solaris 到底能走多远,要看 Runway 接下来能不能把演示变成产品,把产品变成能被千万人使用的日常。但至少在今天,它让我们第一次认真想了这件事:如果软件不用再被"写"出来,那"做软件"这件事,还剩下什么?