夜雨聆风学习资料网

ARTICLE · 1129025

不会编程,怎么让 AI 乖乖把软件做好?我踩坑 5 次换来的 7 条清单

不会编程,怎么让 AI 乖乖把软件做好?我踩坑 5 次换来的 7 条清单
      为了给孩子做英语单词点读软件,我与 AI 智能体来回沟通 5 次,才完整做好一个软件。我把与 AI 沟通的经历做了总结,希望能帮到想利用 AI 做学习软件的朋友。
     很多朋友想用 AI 做一些东西,不是卡在技术,而是卡在不知道如何与 AI 沟通、如何让 AI 真正了解我们的意图。只有让 AI 真正了解我们的意图和想法,才能让 AI 帮我们做出符合需求的东西。
       我给孩子做了个三年级英语单词点读软件,与 AI 来回沟通 5 次才顺手。5 次下来,总结出来的问题几乎都出在沟通上——不是 AI 不会做,是我没把话说明白,没有让 AI 真正了解问题及我的想法。下面我就以与 AI 沟通的实例,来说明我在沟通时存在的问题、踩过的坑,看看如何与 AI 智能体沟通才更有效。

01 报问题,用「现象+期望+场景」三件套

       第一版软件做出来后,我把每个单词都听读了一遍,感觉整体声音不好听、有点太生硬,于是我只说一句“声音太生硬了,听着不好听”。WORKBUDDY 更改了好几次,不是声音速度太快,就是太慢,要么就是有些字母没读出来,尤其是轻辅音,弄了好几次都没成功。最后经过很多次调整,才把读音弄清晰准确。
       后来我总结,与 AI 沟通更稳的说法是——把现象(声音生硬、轻辅音听不清、语速太快)、期望(要像真人说话、自然)、场景(用在三年级单词与字母拼读)这三样全部说全,AI 第一版就能贴着我想要的效果走,不用来回试探。

02 先说清楚,你是怎么“打开”的

       为了能让新增加的单词也有清晰完整的读音,WORKBUDDY 做了两个方案:一个是直接打开的 HTML 文件,一个是本地服务器。双击 HTML 完全离线,只能播预生成的音频,没有系统语音、也不能实时合成新词;本地服务器则能联网实时合成你新加的单词。
      沟通时我只说明了现象,没有说明是通过哪种方式打开的,导致 AI 把两种方式打开的所有路径及代码都重新查看了一遍,浪费了时间与 TOKEN。这次“自加词没声”的根因,就是环境差异。报问题时带上打开方式,能直接定位。

03 分清「课本词」和「你自己加的词」

        我在测试时发现新增加的单词,读音与词库里原来的单词读音不一样。我第一次给 AI 的提示词只说哪个读音不对,没说是新增加的还是原来的,导致 AI 把这两部分程序全部查找了一遍,最后才发现这两类词走的是两套发音通道:课本词和字母走预生成好的离线音频库,你自己加的词需要联网实时合成。
所以报问题时说清“这是课本词还是我自己加的”,AI 立刻知道往哪查,不用从头排查。

04 给我「可复现的最小步骤」

       比如“读几个单词后卡在最后一个字母”,最好带上:读了哪几个词、第几个出的问题、用的什么浏览器、每次都卡还是偶尔。
      能复现,就能秒修;不能复现,只能靠猜。一次说清,能省下大半排查时间。

05 不用懂技术名词,只描述「听感」和「行为」

    你不需要知道太多的专业名词,。你只要说“听着像机器人”“拼读不顺口、间隔太大”“读几个就卡住”。这些你看到的,听到的就行,如果你说太多的专业术语,AI反而容易跑偏。你只管“想要什么效果”,技术选型交给 AI。

06 一次反馈,聚焦一个点

      这 5 轮我每次只提一个点:生硬、间隔、速度、卡顿、自加词音质,所以每轮都能彻底解决。
     如果一次混提三四个问题,容易顾此失彼、互相打架,越改越乱。

07 边界条件,提前说

       像“要离线也能响”“自加词也要同款声音”这种,早说 AI 能一次做全,不用返工。等到验收时才提,就得再开一轮。

写在最后

          经过这几次 AI 对话,我明白了:想要真正用好 AI,首先需要把“问题卡在哪儿、想要啥效果、怎么打开的、是哪种词”讲清楚,剩下的技术活交给 AI。
      如果你也在用 AI 做东西,欢迎留言聊聊你踩过的“说不清”的坑。让我们共同学习、共同进步,更好地利用 AI 为我们服务。

相关学习资料