有消息称,快手即将启动 AI 视频创作工具“likli”的内测,产品定位为“以交付结果为目标的 AI 创作 Agent”,Slogan 是“把下一个 Brief,变成作品”。
通俗来说,likli 充当的是用户的 AI 创作 Agent:先理解需求,再编写脚本,接着生成镜头、完成配音与剪辑,把整套制作流程串联起来,让创意最终以作品形式交付。它可应用于短剧与漫剧、口播与带货,以及品牌与营销等场景。目前,likli 可提供 macOS 版和 Windows 版。
眼下,多数 AI 视频创作工具仍停留在“用户输入提示词,工具输出片段画面”的阶段,只解决画面生成,不负责完整叙事与成片输出。
likli 则尝试换一种路径,由 Agent 接管视频生产的完整链路,把一个想法直接变成一部完整作品。
01 、likli 究竟是什么
可以这样理解:用户给出的是创意,likli 交出的是能够直接交付的成片。整个产品的交互逻辑,可拆成三大核心模块:发起整套创作、过程可视迭代、素材资产沉淀。只要说出想法,就能启动整套创作。
进入 likli 界面后,用户不需要精通提示词工程,用大白话就能下达创作指令。平台内置了多套 Skill 能力,包括配音师、素材分析、剧作家、商品编导,覆盖剧情短片、电商短视频等高频场景。
尤其在电商场景中,上传商品图片并描述产品特征,Agent 就能驱动整套商品短视频制作,适合自媒体、电商内容团队快速产出内容。不同于一键出片的黑盒模式,likli 把创作过程完全开放给用户,让人看见创作过程,掌握作品方向。
很多 AI 工具采用黑盒机制,提交指令后只能等待最终结果,中间无法干预;一旦成片效果跑偏,只能反复修改提示词重新生成。
在 likli 里面,脚本、分镜、画面等各阶段成果都能实时查看。创作途中可随时介入,提出修改意见,迭代画面风格、叙事逻辑,一步步把作品调校到理想状态。控制权被交还给创作者,而不是完全交给 AI 自由发挥。
做完视频之后,产出物也不会用完即丢。资产中心承担素材库的角色,所有图片、视频输出物都会转化为项目资产,可以按类型、项目维度整理归档。过往生成的人物、场景、道具素材能够直接复用,维持整套系列作品画风统一,避免每次生成都出现风格漂移问题。
商业化上,likli 设置有订阅会员,比如包月会员可获得一定积分,大约可以生成 42 次创作任务。当然,也要客观看待这款产品所处阶段。Agent 式全链路视频创作,属于比较前沿的方向。现阶段并不代表 AI 可以做出完美大作,更多是完成从 0 到 1 初稿搭建,再交由人做二次微调优化。AI 负责体力层面重复工作,创作者则更聚焦创意本身。
AI 视频赛道内卷严重,各家比拼画质、时长。likli 的差异化路径,跳出单纯卷画面质量,尝试解决完整内容生产流水线的问题。画质只是其中一环,脚本叙事、配音剪辑、迭代调优、素材管理同样是短视频生产不可忽视的部分。
未来这类创作 Agent 会不会成为内容行业新范式,还有待持续观察。至少这个思路给出一种可能性:AI 工具的终极目标,或许不只是画一张图、生成一小段视频,而是帮普通人把脑海里面的想法,变成一部完整可以交付的作品。
02 、巨头近身交锋:AI 视频赛道迈入商业化决战阶段
快手推出 likli 并非孤立事件,而是 AI 视频创作赛道激烈竞争的一个缩影。
当前,国内大厂纷纷布局。快手在 AI 视频领域采取“双轨并行”策略。
可灵 AI 作为其旗舰级 AI 视频生成平台,主打单镜头画质与物理动态表现,支持最长 2 分钟 1080P 视频生成,具备智能分镜、音画同步、主体一致性等能力,服务全球超 6000 万创作者。
而新内测的 likli 则更进一步,定位为“交付结果的 AI 创作 Agent”,试图从工具升级为“创作伙伴”,接管从创意到成片的完整链路,尤其聚焦电商短视频、漫剧与短剧等高频商业化场景。
字节跳动的打法是“生态整合”。即梦 AI(搭载 Seedance 2.5 模型)作为一站式 AI 创意平台,与剪映深度打通,素材可一键导入剪辑,极大降低创作者迁移成本。
此外,百度有 Hogee,腾讯旗下有 TDream,阿里也有 HappyHorse 视频创作平台,头部 AI 视频赛道上则有 Libtv。
从整体格局来看,AI 视频赛道已从“技术竞赛”进入“商业竞赛”阶段。
各家厂商的策略分化明显:字节通过生态整合将 AI 能力嵌入剪映、豆包、小云雀等产品矩阵;快手以可灵打底、likli 突围,试图在 Agent 模式上抢占先机。
对创作者而言,选择工具的核心逻辑不再是“谁最强”,而是“谁最适合我的场景,谁能快速交付”,性价比同样也是一个重要因素。
03、likli:是快手藏的另一张牌
如果可灵4.0代表的是“模型能力”的进化,那么快手同步内测的likli,代表的是“创作链路”的重的定位是“交付结果的AI创作Agent”,slogan是“把下一个Brief,变成作品”。简单来说,用户输出的是创意,likli输出的是可以直接交付的成片。它把需求理解、脚本策划、分镜拆解、画面与配音生成、镜头编排和音画合成串成同一条工作流,配备7+专业Agent、20+创作能力和28+Skills。
likli最打动人的设计,是“过程可视”。很多AI工具是黑盒机制——提交指令后只能等待结果,中间无法干预,一旦跑偏只能反复改提示词重新生成。likli则把脚本、分镜、画面各阶段的成果实时展示出来,创作者可以随时介入修改。
这背后是一个重要的产品哲学转变:把控制权交还给创作者,而不是完全交给AI自由发挥。
快手在AI视频领域的“双轨并行”策略由此清晰:可灵主打模型能力天花板,likli主打创作链路完整度。两者的组合,回答了一个行业终极命题——AI工具的目标,或许不只是画一张图、生成一小段视频,而是帮普通人把脑海里的想法,变成一部可以交付的作品。
04、中国AI视频的“生态禀赋”
放在全球竞争格局中看,可灵和likli的组合揭示了一个更深层的规律:AI视频的竞争,正在从“模型能力”转向“生态禀赋” 。
可灵的差异化不在于某一项参数领先,而在于它长在快手的平台体内。分发是现成的,第一批客户就是平台上的商家和广告主。平台既是试验田,也是收银台。这种“模型+场景+分发+变现”的闭环,是Sora们不具备的结构性优势。
数据显示,2026年第一季度全行业上线AI微短剧约12.2万部,占比超过95%。艾瑞咨询估算,2026年中国AI视频生成市场规模有望突破200亿元。在这个高速膨胀的市场里,谁能提供从创意到成片的完整流水线,谁就能真正赢得创作者。
可灵2026年预计资本开支将达到260亿元,同比增加近110亿元,增量部分优先分配给可灵AI及大模型相关投资。7月完成近30亿美元独立融资,投后估值180亿美元,腾讯、阿里、百度历史性同台入局。这些数字背后,是一个清晰的判断:AI视频的商业化拐点已经到来。
有行业观察者指出,视频模型长在平台体内,调用负载正在从周末往工作日迁移——“周末调用多,说明大家拿它当消遣;工作日调用多,才说明它真正进入了生产力”。
这才是可灵4.0和likli真正要回答的问题:AI视频到底是一个周末消遣的玩具,还是工作日离不开的生产工具?
从目前的数据和产品走向来看,答案正在变得越来越清晰。
未来,随着多模态理解、长程规划等技术的成熟,AI 视频创作 Agent 有望成为内容生产的新范式,但现阶段仍处于从“可用”到“好用”的爬坡期,人机协同仍是主流创作方式。
可灵4.0杀到:当AI从“画画”变成“拍电影”,谁在重新定义视频创作?
如果说2024年的AI视频生成还停留在“让一张图动起来”的猎奇阶段,那么2026年的可灵,正在干一件截然不同的事——让每一个人,从“我有一个想法”到“作品交付”,中间不再需要一支团队。9月下旬,可灵4.0的邀请制企业封测消息在创作者社区引爆。据多方信息源透露,这一版本在画质、角色一致性、运镜控制、音画同步等维度全面升级,单次生成时长突破30秒,支持4K 10-bit HDR输出,最多可放入15个参考素材,视频还可延长至2分钟。30秒,意味着什么?意味着一场有铺垫、有转折、有收尾的完整戏份,可以在一次生成中一气呵成。角色、场景、声音与风格不再需要拼接缝合,创作者甚至可以描述每个时间点发生的事,自己掌控节奏。从3.0到4.0:一条“连续性”的护城河
2026年初上线的可灵3.0系列,核心突破在于All-in-One多模态体系——不是把功能简单叠加,而是通过统一架构,将影像创作中的理解、生成与编辑整合为一个连续流程。用可灵AI产品负责人温园旭的话说,“去年和今年比较大的一个分水岭,是模态在变得丰富”,过去依赖“图片+文字”的描述方式,文字对于时空关系的描述天然存在缺失,“每个人听到一段文字后,脑海里想象出来的画面都不一样”。3.0解决的是“能不能连贯讲故事”的问题。它支持最长15秒连续生成,引入智能分镜系统,能深度解读剧本意图、自动调度机位与景别。而全球首创的“图生视频+主体参考”技术,则让主角、道具和场景在推拉摇移中始终保持稳定,有效解决了行业长期存在的“主体崩坏”痛点。根据目前流出的信息,4.0将单次生成从15秒拉升至30秒,关键帧从有限数量扩展到最多10个,参考素材上限来到15个——包含最多10张图片、5段视频、7个主体和3个视频主体。这意味着创作者可以用关键帧锁定角色姿势、场景转换和剧情转折,用参考素材混搭图片定调外观、视频带出动作、声音锁定音色,从第一个画面到最后一个画面都保持高度辨识度。更重要的是,4.0把“角色一致性”推到了一个新的高度。据报道,模型在多镜头之间的人物和场景稳定性上有显著提升,这恰恰是可灵一直被行业认可的核心竞争力——“可灵的长处,落在多镜头之间人物和场景的高度一致性上,落在它和分发渠道的打通上,它把AI视频从‘生成一段素材’往前推了一步,推成了‘能直接交付的一个内容单元’”。在画质层面,4.0延续了可灵在原生4K上的先发优势。2026年4月,可灵AI已在3.0系列中上线原生4K直出功能,成为业内首个具备原生4K直出能力的视频模型,“无需经过复杂的后期处理,就能直接输出高分辨率画面,达成影视工业级的视觉效果”。4.0在此基础上进一步引入10-bit HDR,逆光、夜景与霓虹场景能保留更多亮部与暗部细节,色阶断层更少,后制调色空间更大。音频方面同样值得关注。4.0以双声道立体声输出,嘴型与台词更加吻合,语音覆盖中文、英语、日语、韩语、西班牙语、葡萄牙语、德语、法语和印地语,并支持北京腔、台湾腔、东北腔、四川话、粤语等方言以及美式、英式、印度英语口音。音画同步能力的提升,对于短剧、口播带货这类高频场景而言,是决定成片可用率的关键变量。不是“卷画面”,而是“卷流水线”
行业里有一种普遍的误读:AI视频工具的竞争,就是画质的比拼。但可灵的商业化路径证明,真正决定胜负的,从来不只是“好看的单镜头”。有分析一针见血地指出,“短剧团队、电商商家、广告公司要的是一条不返工的流水线,好看的单镜头救不了满是接缝的成片”。这个判断,道出了可灵区别于纯粹技术演示型产品的本质。数据是最好的佐证。2026年第二季度,可灵AI营业收入超过8.5亿元,同比增长超过200%。截至6月,全球用户突破1亿,覆盖224个国家和地区,企业客户近5万家。商业化结构上,B端企业客户API调用收入和P端付费会员订阅收入形成双轮驱动,且两端均保持较好的留存趋势。高盛预计2026年可灵AI收入将达到约2.8亿美元,同比增长超过90%,并指出可灵“在画面一致性、商业场景适配度以及专业创作能力方面仍具竞争力,尤其在企业和专业用户市场具备差异化优势”。这种优势的根源,在于可灵从一开始就锚定了一个更务实的目标:不是做出最炫酷的Demo,而是让创作者能真正用AI完成商业交付。在央视开年大剧《太平年》中,可灵AI参与虚拟场景制作,将传统两个月的任务压缩至两周以内;在微短剧领域,制作成本至少可降至传统的1/3以下,周期缩短超60%。全网爆火的AI短片《纸手机》,由两位非专业创作者用三天时间完成,从分镜到成片几乎所有画面均由可灵生成。4.0的“暗线”:从生成到编辑的闭环
值得特别注意的是,4.0在编辑能力上的布局,可能是比“30秒生成”更具想象力的变化。据报道,4.0允许创作者只修改指定区域——更改角色表情、肢体动作、镜头角度或运镜、整体风格或背景,而画面其余部分保持原样。编辑时最多可输入5段视频,一段作为主视频,其余作为参考。这解决的是AI视频创作中最令人头疼的问题:生成了一条满意的素材,只想微调一个细节,却不得不重新生成全部内容。同时,4.0支持“复刻已验证的成功格式”——给模型一支参考视频,它会掌握其中的节奏、镜头顺序和呈现手法,再换上创作者自己的产品、角色或素材重新打造。这意味着电商商家可以把爆款带货视频的节奏模板化,短剧团队可以把成熟的分镜语言复用迭代,广告公司可以把品牌视觉规范直接注入生成流程。配合可灵此前已经构建的素材资产体系——所有图片、视频输出物转化为项目资产,可按类型和项目维度整理归档,过往生成的人物、场景、道具素材可以直接复用,维持系列作品画风统一——4.0正在把AI视频创作从“一次性生成”变成“可持续迭代”。巨头博弈中的差异化身位
Sora在2026年3月正式关停,被业界总结为“技术能力与商业落地的错配”——全盛期一天烧掉约1500万美元推理成本,整个生命周期从消费端收上来的钱只有两百万美元出头。而可灵的差异化在于,它长在快手的平台体内,“分发是现成的,第一批客户就是平台上的商家和广告主。平台既是试验田,也是收银台”。在与Seedance 2.5的对比中,业界普遍认为Seedance在长单镜头和参考密集型任务上仍有优势,但可灵3.0/4.0的差异化在于多镜头场景的一致性、原生4K层级以及通过Kling Elements实现的可复用角色。4.0如果能兑现角色一致性和音画同步方面的提升承诺,将给商业买家提供两个可信的顶级选项,而两者的价格竞争最终会让所有构建在其上的创作者受益。这种定位的深层逻辑,在快手内部被称为“双轨并行”——可灵AI主打单镜头画质与物理动态表现,而新内测的likli则更进一步,定位为“交付结果的AI创作Agent”,试图“从一个想法直接交付一部完整作品”。两者的组合,正在回答一个行业终极命题:AI工具的终极目标,“或许不只是画一张图、生成一小段视频,而是帮普通人把脑海里面的想法,变成一部完整可以交付的作品”。视频创作的下一个范式
一方面,可灵完成近30亿美元独立融资、投后估值180亿美元,创下全球视频大模型企业单笔融资最高纪录,腾讯、阿里、百度历史性同台入局。另一方面,Sora的关停让整个行业重新审视“技术炫技”与“商业闭环”之间的距离。可灵给出的答案是:AI视频的核心竞争力,正在从“模型能力”转向“创作链路能力”。谁能把从创意到成片的每一步——脚本、分镜、生成、编辑、配音、素材管理——都打磨成一条不返工的流水线,谁就能真正赢得创作者的信任。正如一位行业观察者所言,视频模型长在平台体内,调用负载正在从周末往工作日迁移——“周末调用多,说明大家拿它当消遣;工作日调用多,才说明它真正进入了生产力”。4.0的30秒连续生成、10关键帧、15参考素材、10-bit HDR、可编辑闭环——这些参数背后,是同一个趋势:AI视频创作正在从“碰运气”走向“可预期”,从“生成素材”走向“交付作品”。对于那些曾经因为团队不够、预算不够、时间不够而搁置创意的创作者来说,这可能是最好的时代。