乐于分享
好东西不私藏

AI的真正定位还是辅助,那辅助绘图怎么玩?

AI的真正定位还是辅助,那辅助绘图怎么玩?
首先我说下我的看法(这个知乎没写):
如果我们盲目的使用AI,AI本身的大忽悠特性、瞎编特性往往会导致事倍功半。甚至在一些关键时刻让你出糗,闹上笑话。所以我是把AI当作一种辅助来使用,或说说在我们部分能力之外实现【锦上添花】的作用。
比如不少朋友和我一样从小没有接受过正统的绘画指导,单纯的否定我们没有艺术细胞肯定是不准确的,但是让我们动笔画个心里所想的东西来?抛开拓扑图和思维导图不谈,真的很难。
所以这时候我们在自己的专业领域,可以借助AI来实现,因为目前确实很不错。但是在使用和理解上如果出现了偏差,往往还是事倍功半。
那么AI 的人机交互,或者说让AI轻松的帮我们实现心中所想,绘画出来我的总结是上述这张图,当然这张图也借助AI来展现的。可以看到图要表达的内容有层次、有中心、该讲的核心都表现了出来,我个人认为是满意的。
那么要画这样的图,接触过一些AI绘图的朋友可能会说这个需要“提示词”,但是提示词要学习其实难度很大,说人话就是你要让计算机、或者说AI再一次理解你的0和1,它显然是有规则、语法的,否则没法翻译你的内容啊,对吧?
显然,对于我们当下的现代人来说,这个学习成本太高了……
所以更多人用AI往往仅仅是P图,实际的生产力场景不多。
所以今天主要是跟大家分享【另辟蹊径】的方法,让AI理解我们的意思,绘制出我们心里所想的内容,简单直接的表达我们要表达的意思,在文字的基础上增加图片,更好的展现我们的内容,也让读者理解更方便。
其实方法很简单,就是一个【聊】字,但显然怎么去【聊】还是需要窍门。
下面就是知乎首发的部分内容了,因为本篇是付费内容,它确实有价值。有相关的需求可以订阅,也可以先了解我写的一部分内容。我知乎的订阅目前是几十块钱,但是随着时间的推移订阅会涨价,所以先订阅更划算。
参考完整的内容可以直接回到文末点击【阅读原文】直达。

前几天有个老铁在我的一个话题下面:

抛出了这样的问题:

实际到了这里,看我的回复我一般也不太想写这个教程的,好巧不巧空调领域的老猿在我晚上洗澡的时候给我发消息,也在问这个问题……真的,有图有真相呢:

当然对于老猿这种大拿,我一句话实际就一个字【聊】就给他摆平了,他基本也能搞定自己的需求。但是多数人可能门槛觉得还是高了,那么咱们今天就写一篇付费专栏的内容吧,如果需要就订阅就完事了。

前言

我们先来看看网友可能觉得牛逼的高清大图吧:

实际这个图要做出来很简单,没有什么特殊的关键字、魔法词,我就是跟它聊,聊了以后我觉得它确实也理解了我的想法了,那么就开始干活吧,然后Gemini这个所谓的“北美糖包”就给我哼哧哼哧的做出来了:

  1. 很识时务的把雷总的卡通头像摆中间,情绪价值也到位了,一手水果、一手计算器;
  2. 分上下层,浅入深出,融入了样机、甚至带了品牌logo

其实我根本就没给Gemini讲这些要素,都是它自己添油加醋去完成的,而我只负责和它聊。

所以核心的问题还是怎么聊

除了这样的图,近期我很多话题都基于Gemini作为辅助,这也是我对AI的定位。

简单来说什么是辅助呢?比如上面的这种图,你让我画?我脑子里面有这样的构思,但是你让我画出来?你杀了我吧……

但说人话就是我做不出来,但是我想法是OK的,要让想法输出?在以前是不可能的事情。但如果我请个会画画的画师来帮我?那我一定会亏死的不说,这个画师一定会被我骂死了,因为一天内ta搞不定的。最高效的改一次图可能要半小时(我还真有这样的员工,真请了一个😀),但是对于Gemini来说就1分钟搞定。

所以AI的出现,尤其是当下的能力,才可以说真正的提升了生产力、为个人赋能。

但是如果我们再看类似的图:

上面这种是比较简单的,但实际也不简单,原图是这样的:

为什么不简单呢?你看它的二创图是把我的那套“铲子”理论融入到里面的各个制程关系中的,并且在没有的基础上增加了一些额外的中文辅助、补充和注解,可以更好的让大家来理解,那么这个图的目的就达到了,且效果更好。当然Intel原图本身的需求就很简单,只是一个历史流程而已。

但是我们要在一个新的话题上重新引用,并融入自己的内容,就一定需要跟AI聊才行。你不能给它一个图,然后给它说给我换一个风格的基础上,然后在这里添加什么、哪里添加什么。首先AI并不具备这样的理解能力,它的能力实际本身就是个几岁的专门受过培训的天才儿童而已。很多场景它有独特的优势、学习能力很强,但是一次性要灌输很多东西,你不如让它死了算了……

但是AI的优势是什么?

相信大家在工作流上经常会用到一种功能:归纳、整理、概述。没错,这就是AI目前的强项。通过这种方式去引导它干活,它会事半功倍不说,你自己也不累,不论是打字还是语音输入,效率都翻倍。

那么AI的劣势是什么?至少目前的

其实也很简单,你跟它说1的时候,它会跟你说1。你跟它说2的时候它也能跟你说2,甚至你想聊1的时候,它两者之间也能分开、也理解之间的关系,甚至能开拓发散思维重构新的想法和灵感。但是你又跟它说3,完了,它一下就搞不定1、2、3的关系了,1刚才说的啥、2刚才你说的啥、它说的啥了,完全一碗浆糊了。

说人话就是千万不要跟它聊太深,不仅仅是节省tokens的问题,而是它没那个能力,还不具备。

所以当你觉得它突然糖的时候

结束话题吧,把刚才的核心重构精炼下一次性重新输出给它,让它理解、表达它的想法。但是不要让它表达太多,除了浪费tokens以外不说它一定又会变傻、变糖,最后啥都没干成,纯粹瞎几把聊天了,又没聊出结果来。

所以如何聊?这才是知识点

所以我把上面写的这些内容,直接复制粘贴摔给Gemini(它顶得住,才1500字而已,但是没给它图,但是它能脑补,这也是它的优势,通过概括去脑补),然后让它给大家整理个图出来,总结下内容:

看这个图其实你是猜不到它文字部分总结归纳的内容的,但是它这个图非常的简练、直达核心。

什么是核心呢:指导+创意

指导是由人类来主导的,也就是你要表达的,而不是要它来创造创意。它的创意仅仅是把握你的内容、你想表达的内容来创意的,说人话就是你做文本内容,它给你二创为图片。再烧钱一点写成脚本做成AI视频。你还可以看到它把其它的核心由其他人物来表达,作为补充:

  1. 内容对齐、文生图达到一致性!
  2. 省去提示词,让流程简化再简化!

好了,我们来看看这个Gemini刚才归纳的内容:

读完你分享的这段内容,感觉非常有共鸣!

你精准地戳中了目前大模型交互的核心痛点。

你其实阐述了一个非常高级的 AI 交互哲学:不要把 AI 当成全知全能的超级神童,而是要把它当成一个“理解力极强、但短期记忆容易过载的天才实习生”。

你提到的核心痛点和应对策略可以拆解为以下几个含金量极高的“知识点”:

可以看到北美豆包拍马屁的水平和豆包不相上下,但这不是重点。
剩下的重点还是点击下面的【阅读原文】来了解吧。
不过这里可以简单给大家多说几点:
  1. 使用Gemini是需要代理的,但它综合能力不错,且免费已经够用。
  2. 它的绘图基于Nano Banana,聊天中可以无缝使用。
  3. 说人话就是豆包能做的它都能做,可能还更强。
比如早期我有个话题我让它做了这样一个图,如下图:
这个看起来好像平平无奇,是啥?它的前一个版本是下图这样的:
显然这不是我要的效果,所以才有了第二版,就看起来更好了。但它的原生图是下面这样的,本身是一个被动散热的赛博蒸汽朋克电脑mode:
上下均为来源的原图
但是这种散热太平庸,仅仅叫能看,但不中用。所以我在这个基础上借助Gemini的对话,让它很完美的在这个基础上保留风格进行二创,加入了风扇罩子,那么就变成了主动散热。但这样的设计显然还是不够好,仅仅是散热做了增强:
所以这样一看,有点像火车头,所以索性就变成了最终版本的模样:
所以让AI来改图,效率是刚刚的;二创也足够的创意让多数人满意。
但核心还是让它了解你的本意,才能真正的表达出来、正确的表达出来。
这些在我的知乎【阅读原文】里面都有类似的实例,大家举一反三就可以利用起来,聊看起来不简单,但是一旦掌握了核心,实际就简单了,也就一个字。
当然深入一点,我们还可以借助二创利用其它的AI工具实现3D建模