我平时接设计单子
最磨人的不是设计,是整理素材
客户发来的素材有 JPG、PDF、Word 等各种格式,文字我一般是用微信截图「提取文字」,方便是方便,就是每次都要截一下,麻烦。图片更费事,得一个个格式打开去抠出来,又费力又费时,素材整理得多了,我一直在想:有没有更省事的办法?
最近「vibe coding」这个说法挺火
用大白话讲,就是用嘴编程——不用自己写代码,用平时讲话的方式跟 AI说需求,它就可以帮你把代码写出来,你试、你说「这里不对」,它再改
总体就是:人负责方向和感觉,代码交给 AI
我心想:这个我是不是也能试试?
正好天天折腾这些素材,那就拿它练手,做个随拿即用的小工具,方便自己
说干就干!我打开 Claude,对它说:「我想做一个工具,能一键提取PDF里的文字、图片和表格,完成后给我 Word 文档和打包好的图片文件」
接着它就开始 kuku 干了起来
代码一行行往外写(badabadabda)
你要问我能不能看懂?问就是不能,哈哈哈
大概等了一会儿,它给了我一版
我拿手头的 PDF 素材试了一遍
能跑,但不完全对,图片提取出来,颜色不对...
我把问题丢给它,它说是图片格式的问题,调了一下。我再试,颜色正常了,又拿几个文件来回试,都稳了!!!
这工具,就这么能用了✌️
工具能用了,但我用着还是别扭。因为第一版得在终端敲命令才能跑起来
我做产品设计的,总觉得有个页面看起来直观些,而且文件直接拖拽上传也方便。干脆就让 Claude 又跑了一个本地网页版:打开页面,把文件拖进去,点一下,文字、图片、表格就都出来了
改完之后我才觉得,这下子对味儿啦!!!
回头想想,这件事最让我有成就感的,不是说工具多厉害,而是「我能按自己的想法,做个趁手的小工具,解决自己真实的需求」这件事本身
希望这篇教程能对大家有所帮助!
一名产品设计+ AI 实践者

感兴趣的话欢迎你的关注 一起学习!
夜雨聆风