ARTICLE · 1129025
不会编程,怎么让 AI 乖乖把软件做好?我踩坑 5 次换来的 7 条清单
不会编程,怎么让 AI 乖乖把软件做好?我踩坑 5 次换来的 7 条清单 为了给孩子做英语单词点读软件,我与 AI 智能体来回沟通 5 次,才完整做好一个软件。我把与 AI 沟通的经历做了总结,希望能帮到想利用 AI 做学习软件的朋友。 很多朋友想用 AI 做一些东西,不是卡在技术,而是卡在不知道如何与 AI 沟通、如何让 AI 真正了解我们的意图。只有让 AI 真正了解我们的意图和想法,才能让 AI 帮我们做出符合需求的东西。 
我给孩子做了个三年级英语单词点读软件,与 AI 来回沟通 5 次才顺手。5 次下来,总结出来的问题几乎都出在沟通上——不是 AI 不会做,是我没把话说明白,没有让 AI 真正了解问题及我的想法。下面我就以与 AI 沟通的实例,来说明我在沟通时存在的问题、踩过的坑,看看如何与 AI 智能体沟通才更有效。 第一版软件做出来后,我把每个单词都听读了一遍,感觉整体声音不好听、有点太生硬,于是我只说一句“声音太生硬了,听着不好听”。WORKBUDDY 更改了好几次,不是声音速度太快,就是太慢,要么就是有些字母没读出来,尤其是轻辅音,弄了好几次都没成功。最后经过很多次调整,才把读音弄清晰准确。 后来我总结,与 AI 沟通更稳的说法是——把现象(声音生硬、轻辅音听不清、语速太快)、期望(要像真人说话、自然)、场景(用在三年级单词与字母拼读)这三样全部说全,AI 第一版就能贴着我想要的效果走,不用来回试探。 为了能让新增加的单词也有清晰完整的读音,WORKBUDDY 做了两个方案:一个是直接打开的 HTML 文件,一个是本地服务器。双击 HTML 完全离线,只能播预生成的音频,没有系统语音、也不能实时合成新词;本地服务器则能联网实时合成你新加的单词。 沟通时我只说明了现象,没有说明是通过哪种方式打开的,导致 AI 把两种方式打开的所有路径及代码都重新查看了一遍,浪费了时间与 TOKEN。这次“自加词没声”的根因,就是环境差异。报问题时带上打开方式,能直接定位。 我在测试时发现新增加的单词,读音与词库里原来的单词读音不一样。我第一次给 AI 的提示词只说哪个读音不对,没说是新增加的还是原来的,导致 AI 把这两部分程序全部查找了一遍,最后才发现这两类词走的是两套发音通道:课本词和字母走预生成好的离线音频库,你自己加的词需要联网实时合成。 所以报问题时说清“这是课本词还是我自己加的”,AI 立刻知道往哪查,不用从头排查。 比如“读几个单词后卡在最后一个字母”,最好带上:读了哪几个词、第几个出的问题、用的什么浏览器、每次都卡还是偶尔。 能复现,就能秒修;不能复现,只能靠猜。一次说清,能省下大半排查时间。 你不需要知道太多的专业名词,。你只要说“听着像机器人”“拼读不顺口、间隔太大”“读几个就卡住”。这些你看到的,听到的就行,如果你说太多的专业术语,AI反而容易跑偏。你只管“想要什么效果”,技术选型交给 AI。 这 5 轮我每次只提一个点:生硬、间隔、速度、卡顿、自加词音质,所以每轮都能彻底解决。 如果一次混提三四个问题,容易顾此失彼、互相打架,越改越乱。 像“要离线也能响”“自加词也要同款声音”这种,早说 AI 能一次做全,不用返工。等到验收时才提,就得再开一轮。
经过这几次 AI 对话,我明白了:想要真正用好 AI,首先需要把“问题卡在哪儿、想要啥效果、怎么打开的、是哪种词”讲清楚,剩下的技术活交给 AI。 如果你也在用 AI 做东西,欢迎留言聊聊你踩过的“说不清”的坑。让我们共同学习、共同进步,更好地利用 AI 为我们服务。
