AI 小白训练营 30 讲 · 第 22 讲
工具调用是什么?AI 为什么需要浏览器、终端和文件
前两讲我们说,Agent 要从回答走向执行。那它具体靠什么执行?答案是:工具调用。
大模型本身很像一个会思考、会表达的大脑。但如果它没有浏览器,就看不到网页;没有文件能力,就读不了你的资料;没有终端,就跑不了测试;没有外部接口,就无法上传、查询或同步结果。
工具调用,就是把这个大脑接到外部世界。
工具让 AI 看见真实状态
没有工具时,AI 只能根据对话和训练中学到的知识回答。它不知道你电脑里有哪些文件,不知道网页现在更新到了哪里,也不知道刚才那条命令到底有没有报错。
有工具之后,它可以先看再说。
浏览器让它查看网页和资料;文件工具让它读取、生成、修改文档;终端让它运行脚本、测试和构建;接口让它和外部系统交换信息。每一种工具,都把 AI 从“脑内回答”往真实任务推进一步。

工具调用的本质,是让 AI 不只根据想象回答,而是能观察、操作、拿反馈。
工具调用不是随便点按钮
一个可靠的 Agent 不会一上来乱操作。它要先判断:当前任务是否需要工具?需要哪一种工具?应该传入什么参数?拿到结果后怎么解释?
比如查资料,要用浏览器;整理书稿,要读写文件;排查程序,要跑测试;上传公众号草稿,要调用接口并回读字段。不同任务需要的工具不同,检查方式也不同。
这就是为什么好任务要写清楚验收标准。你不能只说“帮我处理一下”,最好说“生成文件后检查是否存在,上传后回读标题和封面字段,测试后汇报失败项”。这样 Agent 才知道怎么判断自己有没有完成。
工具越强,边界越重要
工具调用也带来风险。
能读文件,就要注意隐私。能改文件,就要避免误删误改。能发接口请求,就要防止误发布、误付款、误同步。能运行命令,就要防止破坏环境。
所以 Agent 时代的关键词不只是“自动化”,还有“权限”和“验证”。哪些操作允许做,哪些必须先问人,哪些结果必须回读确认,这些边界比工具本身更重要。
今天的小结
第 22 讲的重点是:工具调用让 AI 连接外部世界。浏览器让它看,文件让它读写,终端让它运行,接口让它和系统交互。没有工具,Agent 只能建议;有了工具,它才可能行动。
但工具越多,越要有边界和检查。下一讲,我们就讲 Agent 最大的问题:它能做事,也可能做错事。
· · ·
下一讲:Agent 最大的问题:它能做事,也可能做错事。
夜雨聆风