ARTICLE · 991346
把 AI 装进相机,不等于有了一台 AI 相机:影石 GO Ultra 的 Kira 语音

我一直很喜欢这台 GO 2。几年来,我把它挂在胸前、夹在帽檐上,或者吸附在一些角落,拍过不少有意思的画面。所以,我也打算趁这个机会升级一下装备。
正好最近,Insta360 在 GO Ultra 上推送了新固件,开始支持 Kira AI 语音助手。于是我研究了一下。
坦白说,可能是我一开始理解有偏差,这个功能没太打动我。我甚至有点怀疑,Insta360 有没有真正想清楚它的价值。
相比几年前,现在拇指相机这个品类已经多了不少选择。除了 Insta360 一直在迭代 GO 系列,大疆也在 2025 年 9 月推出 Osmo Nano,直接加入竞争。
根据 IDC 的数据,2025 年,Insta360 GO 系列占据了可穿戴相机品类 57% 的市场份额;到了 2026 年第一季度,大疆 Osmo Nano 已经拿下过半的出货量份额。
除了大疆这个强劲对手,也有一些新玩家开始从 AI 寻找差异化。比如 Looki L1 穿戴相机,主打全天候的 AI 生活记录;追觅生态下的 LEAPTIC Cube,则把 8K 视频、48 TOPS 算力和 AI 拍摄助手作为主要卖点。
在这个背景下,Insta360 为 GO Ultra 推送了 Kira 多模态 AI 语音助手。目前公布的功能主要包括:
多国语言互译语音问答拍图问答声纹识别
对一款经常在旅行中使用的相机来说,这些功能确实有场景。
你可以让它充当翻译机,也可以询问天气和交通信息。旅行中看到感兴趣却不认识的建筑、植物或者文字,如果 GO Ultra 恰好吸附在胸前,你可以直接说「Hey Kira」,让它识别镜头前的信息,再通过语音告诉你答案,免去掏出手机操作的麻烦。
但这种便利也有边界。
我一直觉得,语音是一种不对称的交互方式:在输入端,它很快、很自然;到了输出端,却因为慢而且线性,只要信息稍微复杂一点,体验就会变得难受。很多时候,手机反而能让人更快地扫读和确认完整信息。
另外,这些功能无法离线使用。设备需要借助手机连接云端大模型:国内使用千问,海外使用 Gemini。相机负责采集语音和图像,语义理解和回答生成主要发生在云端。
这里顺带说一个容易产生误解的地方。
网上有些文章把 Kira 与 GO Ultra 上那颗 5nm AI 芯片直接关联起来。但目前搜到的信息,GO Ultra 使用的是安霸(Ambarella) CV52 视觉处理 SoC。
这是一颗面向运动相机的低功耗芯片,集成 CPU、ISP、视频编解码器和 AI 视觉引擎,主要负责图像处理、4K 视频编码、电子防抖、HDR 和夜景降噪,与依赖云端大模型的 Kira 并不是同一套能力。
说白了,Kira 目前提供的功能,单独看都有用,却没有哪一项必须由 GO Ultra 来完成。本质上,它跟你直接在手机里使用千问 App 没有太大区别,甚至在手机上还能更快、更完整地看到信息。
Kira 更像是在 GO Ultra 原本的拍摄能力之外,增加了一组 AI 功能,试图拓宽这台相机的使用场景。
但问题也随之而来:当它想把 GO Ultra 变成一个随时可以唤起的 AI 助手时,却受到这台相机原有硬件设计的限制。

-
捉襟见肘的续航,不适合让 AI 时刻待命
Kira 现在描绘的,是一个可以随时开口询问的使用方式。但 GO Ultra 的硬件设计,首先服务的仍然是拍摄,而不是让 AI 助手长时间待命。
要使用语音唤醒功能,有几个前置条件:
GO Ultra 需要处于待机状态;手机要在约 10 米范围内;手机需要保持联网和蓝牙开启;Insta360 App 要能在后台运行;相机不能因为自动关机设置进入关机状态。
根据官方数据,在语音问答和拍图问答的典型混合使用状态下,GO Ultra 单机续航约为 56 分钟,配合拓展舱约为 158 分钟,实际使用中还可能受到环境和使用频率影响。
作为对比,主打全天候生活记录的 Looki L1,宣传待机时间为 9~13 小时。当然,两款产品的硬件性能和工作负载并不相同,这个数字不能直接比较,却足以说明它们从一开始瞄准的就是两种不同的使用方式。
对于一台以拍摄为核心任务的拇指相机来说,这是一笔很现实的取舍。
在本就捉襟见肘的续航下,我大概不会只为了少掏几次手机、随时问几个问题,就让 GO Ultra 长时间保持 AI 助手待命。因为当我真正需要使用相机时,我首先希望它还有电,能够把眼前的画面拍下来。
不过,续航只是表面问题。即使未来硬件升级,让 Kira 可以全天待命,它依然要回答一个更重要的问题:
它究竟帮助用户完成了哪一部分拍摄任务?

-
Kira 被装进了相机,却没有真正进入拍摄流程
一次完整的影像创作,大概会经过几个阶段:产生拍摄意图,选择合适的模式和参数,采集素材,从大量素材中找到符合主题的高光片段,再把它们组织成一条可以分享的视频。
我之前在《AI 硬件价值的 5 个拷问》中分析 Looki L1 时提到,这款产品将很大一部分创作主动权交给了 AI:由 AI 决定什么时候记录、保留哪些片段,再把它们组织成一段生活故事。
这种做法未必是最好的答案,但至少 AI 真正参与了创作过程。
相比之下,Kira 目前几乎游离在 GO Ultra 的影像创作流程之外。
不少人认为 Kira 做得克制、边界清晰。但我觉得,它真正的问题并不是支持的功能多还是少,而是它还没有进入相机最核心的工作流。
毕竟,我购买相机最主要的目的,是拍到自己想要的画面。既然 AI 被当成主打功能,至少应该帮助我更好地完成这件事。
目前来看,Kira 与这条链路的结合仍然非常有限:
第一,开始录像后,用户暂时无法唤醒 Kira。官方给出的原因,是要保证录像稳定性和画质。
第二,Kira 目前还不能感知相机自身的状态。用户不能问它还剩多少电、SD 卡还有多少空间、当前使用了什么拍摄参数。
第三,它对相机的控制仍然比较基础,主要包括拍照、开始或停止录像、调整提示音量和关机等。它还不能通过自然语言理解用户的拍摄意图,再完成更深入的模式和参数设置。
这些操作在正常情况下用手完成并不困难。但当用户双手不方便,或者无法看到屏幕时,语音交互的价值才会真正体现出来。
比如,用户正在骑行、跑步或者照看孩子,双手不方便操作相机,语音本来是一种非常合理的交互方式。但恰恰在这些真正需要免手操作的拍摄过程中,Kira 还不能发挥多少作用。
很多普通用户对相机的模式和参数也没有那么熟悉。这时,通过自然语言描述自己想拍什么,让相机给出建议或者直接完成设置,同样是一个真实而有价值的场景。
反过来,当用户可以停下来,专门拿着相机询问眼前的建筑是什么时,他通常也可以拿起手机。
AI 被装进了相机,却还没有真正进入拍摄。
-
开个脑洞:我理想中的相机 AI 助手
我始终觉得,AI 能够很好地优化影像类硬件的体验。只不过,它真正应该进入的,不是一个与相机并列的通用问答入口,而是从拍摄到剪辑的整个工作流。
在拍摄之前,AI 可以先理解用户想拍什么。
比如,我准备戴着相机骑行,希望画面有速度感,但又不想录满一路无聊的素材;或者我带女儿出去玩,主要想拍下她的表情,希望尽量避免逆光下人脸太暗;又或者我打算记录一整天,愿意牺牲一部分画质来换取更长续航。
对不熟悉摄影参数的普通用户来说,比起研究分辨率、帧率、曝光补偿和不同视角的区别,直接告诉相机自己想拍什么,再由相机给出拍摄建议,甚至提供一套清晰的操作方案,显然更容易降低门槛。
如果 AI 已经判断出了合适的设置,最好的体验甚至不是告诉用户「你应该把某个参数调到多少」,而是在获得授权后,直接替用户完成调整。
拍摄过程中,语音的价值会更加明显。
用户可以在不腾出双手的情况下切换模式、调整视角、标记刚才发生的高光,或者告诉相机:「接下来重点拍前面穿黄色衣服的小孩。」相机也可以在镜头被遮挡、曝光明显异常或者电量不足时,恰当地提醒用户。
这里的 AI 不需要陪用户聊天,也不必回答百科问题。它只要更准确地理解用户此刻想拍什么,并帮助相机完成拍摄,就已经很有价值。
而在拍摄之后,AI 能解决的问题可能更多。
旅行中真正困扰我的,通常不是没有拍到足够多的素材,而是拍得太多。
几十段甚至上百段视频躺在相册里。要把它们逐个看完,找出高光,判断前后关系,再剪成一条可以分享的视频,需要花费大量时间。很多素材最后没有被整理,不是因为它们不值得保留,而是因为剪辑的门槛太高。
如果我可以直接告诉 AI:
把这几天的视频剪成一条两分钟的旅行短片。重点保留女儿第一次浮潜,以及她和新朋友一起玩的片段。节奏自然一点,不要太多花哨的转场。
它能够理解我提到的人物、事件和时间关系,从素材库里找到对应片段,完成一版初剪,再根据我的反馈继续调整,这才是我真正愿意使用,甚至愿意付费的 AI 功能。
今年 5 月正式开售的 LEAPTIC Cube,其 AI 助手其实已经在往这个方向探索。按照它公布的产品定义,AI 会介入拍摄前、拍摄中和后期处理。用户可以通过自然语言切换模式、调整设置和添加标记;相机则根据环境和场景进行画面优化。
这些能力实际能做到什么程度,还需要经过更多真实体验验证。但至少,LEAPTIC Cube 正在试图回答:AI 如何成为一名拍摄助手,而不只是相机里的聊天助手?

图片来源:LEAPTIC官网
-
也许我想错了,Kira的企图可能在别处
Insta360 其实也有面向影像工作流的服务。
相比 Kira AI 语音助手,7 月发布的 AI 成片服务「时刻 Pro」,反而更接近我对相机 AI 助手的期待。
时刻 Pro 是一项基于 Insta360+ 云相册的 AI 剪辑增值服务,可以自动完成选片、分镜、配乐,并生成标题和封面。按照官方发布时的描述,它还会逐步支持通过自然语言进行对话式创作。不过,从目前面向用户的实际功能来看,创作方向仍然比较依赖预设的场景、风格和主人公,成片后的精细调整能力也比较有限。

图片来源:Insta360官网
但这种围绕素材理解和自动成片展开的能力,显然比 Kira 更接近影像用户真正的痛点。
遗憾的是,目前这些能力仍然像几块彼此分离的拼图:相机里的 Kira 既不理解用户想拍什么,也不知道用户已经拍下了什么;负责识别高光和生成视频的 AI 虽然能够理解素材,却无法继承用户拍摄时的意图,也不能围绕生成结果与用户持续对话和迭代。
如果这些能力能够真正串联起来,让 Kira 在拍摄前理解意图、拍摄中提供指导、拍摄后参与选片和成片,它才可能从一个装进相机里的通用语音助手,真正变成一名属于 GO Ultra 的影像助手。
而现在的Kira更像是:既然 GO Ultra 已经有摄像头、麦克风和扬声器,能不能顺便把它变成一个随身多模态入口?
大胆猜测,这次尝试未必只服务于 GO Ultra。
GO Ultra 已经有一批存量用户,Kira 又是一次免费的软件更新。Insta360 也许可以借助真实用户的使用,继续观察验证有价值的使用场景,再逐渐扩展它的能力。
毕竟创始人刘靖康还说过,Kira可能成为市场上除Meta之外,存量和出货量最大的个人AI助手。都开始对标每天都带着的Meta AI眼镜了,GO Ultra 可能只是一次试水,为以后更适合承载这类 AI 助手的硬件积累经验。
当然,这也只是个脑洞。
只看Kira目前在 GO Ultra 上提供的功能,我仍然觉得,它还没有想得特别清楚。
所谓 AI 相机,并不是往相机里塞进一个大模型入口。真正的区别在于,AI 有没有理解这台硬件原本为什么存在,又有没有进入它最核心的任务。
-
写在最后
好了,虽然上面说了很多,我最后大概率还是会选择 GO Ultra。
一方面,是源自多年来我对这个系列的喜爱和信任;另一方面,GO Ultra 本身也确实是一款足够优秀的产品。
但当前的 Kira,对我来说更像一个有意思、却还不足以构成购买理由的附加功能。
这几年,越来越多硬件开始接入大模型。厂商似乎很容易陷入一种冲动:只要产品有麦克风、扬声器或者摄像头,就应该给它加上一个 AI 助手。
但 AI 助手能回答更多问题,并不等于这款硬件因此获得了新的价值。
就像我之前写智能音箱时得出的判断:技术能力升级,不等于产品任务升级。
对一台相机来说,AI 的价值也不在于它能回答多少问题,而在于它能不能帮助用户拍到、找到并表达那些真正值得留下的时刻。