ARTICLE · 1029632
今天的中美AI 阵营,每个人都在战场上!
今天的中美AI 阵营,每个人都在战场上!GPT-6 上线后,很多人手里的“笨 AI” 瞬间不香了。 本来前几周 Kimi k3 拿到了几项第一,排名开始挑战美国第一梯队 AI,work、浏览器自动化用的还不错,妥妥的国内第一梯队。但是试用过 GPT-6 之后,感觉代差又明显拉大了。 我自己的测试,Kimi K3 可以轻松完成的任务,豆包、Qclaw、workbuddy 干起来明显吃力。 比如调研一个前沿问题,写好文章,插图,发送到我公众号的后台草稿,等我改一下就发布。 这件事实测,K3 非常智能,可以说基本上达到满意的程度,唯一的小差距是文章写的还不如自己写的好,缺少一些“人“气。 但是豆包和其他 AI 明显差一个档次。我让它找 10 个选题,但是控制浏览器存后台的事情,明显还做的不好,其实就是一个拷贝粘贴的事情,但是目前国内的 AI,看和听的能力还不足,它们都采用年初 Claude 的办法,截图,看图,然后用程序模拟鼠标点击,绕过网页的 AI 自动化监控。 目前 Kimi 的能力,和上一代 Claude 基本持平。 可用。 就是额度太少了,我用的是Allegretto 这个玩意。 
本来是 199/月,但是因为之前 kimi算力不足,没法注册会员。我一看我还能续费,就交了一年的费用。 现在回想,有点冲动了。 因为 GPT-6 上线之后,把网页免费版升级到了 luna,这玩意能力就已经很强了,配上 Image2.0 生图模型之后,基本上秒杀同级别 AI。 就是说付费用户有更好的模型了,原来的模型就下放给你们免费玩。 去试试就知道有多香。 所以特朗普在电话里说,以前那都是骗人的,我们现在赚钱能力很强。 你听基本上不一定能听懂,我来拆解一下: 之前为什么限制我们芯片?因为米国人认为,没有顶级的芯片,你的 AI 就训练的没有我好。 确实是这样,GPT-6 放出来之后,也证实了这一点,确实是代差级的领先。 而用户一旦有了更高级的模型,就没人再愿意用低级的。 当然这只是限制在一少部分顶级 AI 用户身上,大多数老百姓,还在跟豆包每天瞎聊。 而国内的一小部分用户,每天在琢磨,怎么用 AI 帮自己干活。 从养虾开始,一阵风过去,为什么现在很多人不说这个事情了? 因为大部分人部署成功之后,很长一段时间里,其实是不知道自己应该干点啥的。 很多白领,也就满足于做点自动化任务,帮自己做做调研,改改 ppt,弄点报表之类。 这很危险,因为他们在亲手用 AI 取代自己。 上周我参加了一个评审,其中有个项目,是一个公司财物,自己手搓了一个智能体,用 AI把自己每个月的工作,浓缩到一天干完。 你说这是不是有问题?他只看到了 AI 帮自己减轻负担,却没想到如果 AI 能帮自己干完一个月的工作,公司养你做什么? 所以现在有大批的自媒体创作者,热衷于让 AI 帮自己生产内容。 我之前的文章,其实都是 kimi 和豆包写的,然后我再改改就发出去。 只有今天,是一个字一个字敲进去的。 你们能明显看到,人类思维的跳跃性。 AI 写不出这么不连贯的跳跃性思维。 为什么我手敲? 因为我的 kimi 会员 199 每月的额度,被我10 天用光了。我还不想续费。 因为看到了 Gpt-6 的能力,不想交钱了。 豆包我也不想续费了,与其每个月 68 养一个傻 X,不如免费用一个聪明人,虽然免费用户没有 work 自动化能力,但是手动粘贴也没费多少时间。 就是这手动粘贴这一下子,你需要交每个月几百的费用。不划算。 现在回到文章标题,为什么说我们每个人都在战场上。 美国的 AI,是机房训练出来的,10 万块顶级显卡。不卖。 中国的 AI,靠的是每个人的不断训练和对话,是人来训练的。 我们算力不够,但是靠1-3% 的算力,优化训练,也能取得 90% 左右的接近度,前几个月美国还有点惊。 这个月又开始骄傲了,因为这个 GPT-6 确实有点强的超乎想象。 现在放出来的这个模型,其实已经是上一代了,下一代即将完成训练。这个思路,和我们是一样的,必须有代差储备,才能卖。 
Bel 是下一代模型,这个玩意其实已经训练完成了,等下一轮收割。 而今天我们看到的消息,是字节和腾讯、阿里在争抢 work 的桌面。 今天我被拉到了豆包的一个飞书群,豆包专员一对一指导问题,遇到什么问题,可以直接反馈。 我直接把骂豆包的后台记录反馈过去,因为给我气坏了,kimiK2.6 一句话就能干好的任务,豆包干了一下午,浪费了我 1 天的额度,还没干成。 连我都能给拉到特殊对待的群里,说明豆包很着急了。 你们如果看消息,能明显感受到这几周,腾讯 workbuddy 的宣传和攻势铺天盖地,到处都是。 其实,2 个月前我就被拉到了 workbuddy 的专员群,有问题就提。 但是当时它能力太弱,打开看一眼,不灵,就放一边了。 今天打开看了一下,哇塞,原来 workbuddy 和 Qclaw 是红蓝队,也开了本地模型和云端模型能力,这就有意思了。 
我把本地几个小模型导进去:这玩意就不花钱了,简单任务可以本地跑。 这招确实够狠,同时还开放了很多后台第一梯队模型,夜间有折扣 
适合睡前做任务。 最重要的是开放了混元 4 的预览版, 同时混元 3 和混元 4 都免费使用,无限 token。 那还不赶紧薅羊毛,毕竟现在好用的算力都贵着呢。 
为了国产模型崛起,我就勉为其难,帮他们训练一下。 谁让人家免费呢。既然你大度,我也来帮你培养一下你的模型。 所以现在国产模型都在追自动化和本地化任务,这个其实用的人多,也可以产生一些作用。至少可以帮助训练人员了解哪些方面还需要加强。 不过奉劝一句,不要用什么 skill 和能力包,很多 skill 里面的要求和能力,在现在的第一梯队 AI 能力面前,都过时了,如果你给豆包一个 商店里下载的 skill,它可能犯错误的概率,比用模型自己思考还多。 就好比去年很多人钻研什么提示词技巧,提示词工程。结果 GPT-6 出来之后,根本不用你废话,几句话说清楚你要啥,结果就非常惊艳。 不要在 AI 上耗费太多精力,去研究哪些很快就会过时的所谓“技巧”或者“技术”。 我们需要思考的是,如果下一代 AI 都非常聪明,你应该用它去干点啥? 很显然,答案不可能是:取代自己! 今天每一个字都是手敲的,因为kimi 额度用完了,好累啊。 我是不是该给 kimi 充钱了?支持一下国产 AI? 今天说到这。有时间继续聊。




