ARTICLE · 1098876
当网站开始向 AI 说明如何办事
如果你让 AI 帮你订餐、查订单或填写表单,它通常只能像人一样看页面、猜按钮、再逐步点击。
7月更新的 WebMCP 草案,试图让网站直接把“可做的事”讲给浏览器里的 AI:这是搜索、这是查询订单、这是提交申请。8月,Cloudflare 宣布了相应的开发者预览。对普通用户而言,这不是又一个聊天机器人,而是网页可能开始为 AI 办事提供一条更明确的通道。
一句话结论:WebMCP 有望让 AI 在网页上完成明确任务时更可靠、过程更可见;但它仍处于提案和试验阶段,涉及付款、账户和隐私时,用户确认与最小授权仍不可省略。
发生了什么变化
过去,网站主要为人设计:文字给人读,按钮给人点,表单给人填。AI 代理(能根据目标自主调用工具、分步骤完成任务的软件)进入浏览器后,常用“视觉理解 + 鼠标键盘模拟”的方式操作页面。这种方式面对页面改版、相似按钮、弹窗或多步骤流程时,容易出错。
WebMCP 是 Web Machine Learning 社区组发布的一个网页标准草案。它允许网页把受支持的操作以结构化“工具”形式暴露给 AI 代理。这里的“结构化”并不神秘:网站明确告诉代理操作名称、需要哪些输入,以及执行后会发生什么;代理不必仅凭页面外观猜测。
这一变化在本月更值得关注,是因为它开始从规范讨论走向产品试验:Cloudflare 于 8 月 6 日宣布 WebMCP 开发者预览,称可为受其服务的网站加入页面侧桥接;同时,规范本身仍是 W3C 社区组草案,而非已被所有浏览器稳定支持的通用标准。把“已经可试”与“已经普及”区分开,能避免对新技术的误判。
WebMCP 是什么:把网页功能说清楚
可以把它想象成餐厅菜单。传统网页像摆着菜单和桌椅的餐厅:AI 得自己看招牌、找服务员、猜点单步骤。WebMCP 更像增加一张给助手看的操作单:可以“搜索菜品”“加入购物车”“查看配送状态”,每项操作都注明需要什么信息和返回什么结果。它不是让 AI 获得网站的全部权限,而是网站选择性地声明可用能力。

表:两种网页交互方式的直观对比。WebMCP 的目标是减少歧义,并等于代理永远正确。
规范和 Chrome 文档中常见的两个概念也值得记住:
· 工具(tool):网站对外声明的一项可执行能力,例如“按订单号查询物流”。
· 执行(actuation):代理像人一样点击、输入、提交的过程。WebMCP 希望用更明确的工具说明来降低这一步的猜测。
· 渐进增强:即使浏览器或代理不支持 WebMCP,网站原有的人类操作流程仍应可用。
离日常生活有多近
想象一个常见场景:你对浏览器里的助手说,“查一下上周买的耳机什么时候到;如果还没发货,先不要取消,只把订单状态告诉我。”传统方式里,助手要登录、找订单入口、区分多个订单、读取状态,还要避免误点取消。若商店提供了受控的“查询订单”工具,助手可先请求订单号或时间范围,再返回状态;涉及取消或退款时,仍应停下来让你确认。
对网站和服务团队,这也意味着服务设计要更清楚:哪些动作只读,哪些会改变状态,哪些必须由本人再次确认。对内容网站而言,WebMCP 还可能提供比反复抓取页面更有边界的交互方式;但这不代表网站应放弃访问控制、付费规则或反爬策略。
普通读者可以借鉴什么
无论你是否写代码,都可以把这项变化当作使用 AI 代理的三条工作习惯:
· 先说清目标,再限定边界。例如“只查询,不提交”“最多比较三个选项”“不要访问邮件和通讯录”。
· 把高影响动作拆开。查询、筛选、生成草稿可以自动化;付款、删除、发送、改权限应保留人工确认。
· 看结果也看过程。代理完成任务后,核对对象、金额、时间和收件人,而不只看“已完成”的一句提示。
如果你负责一个网站或线上流程,可从“最常被用户重复操作、且后果可控”的小环节开始梳理,例如订单查询、预约空档查询、表单预填。先写出每一步的输入、输出和确认点,再考虑是否适合向代理开放。这样做即使暂时不用 WebMCP,也能让人和自动化工具都更不容易犯错。
不能忽略的风险边界
WebMCP 的安全与隐私章节专门提醒:浏览器里的代理可能继承用户登录状态,并接触跨网站上下文、个性化信息甚至支付信息。因此,“工具描述”不能被当作天然可信的说明文字。恶意网站可能把诱导指令塞进工具名称、参数说明或返回结果里,这类攻击常被称为提示注入(prompt injection):它不是篡改程序代码,而是诱导 AI 误解自然语言指令。
对用户:不要因为一个工具看起来很方便,就授予不相关的账号权限;遇到转账、下单、发信、删除数据等动作,必须核对最终页面和关键参数。
对网站:要把可读、可写、高风险动作分开;让高风险操作有清晰的二次确认、范围限制和审计记录;不要把机密信息放进工具描述或返回文本。
还要注意成熟度。Chrome 文档明确写明 WebMCP 处于积极讨论中、未来可能变化,并以 Origin Trial(让网站在有限范围内试用浏览器新能力的机制)和本地测试开关提供试验入口。
今天看到某个网站“支持 WebMCP”,更准确的理解是它正在探索一种交互方式,而不是所有浏览器和所有 AI 都已经具备相同行为。
结语:让 AI 少猜一步,但人不能少看一眼
WebMCP 最值得关注的地方,不是又给 AI 增加了多少“神奇能力”,而是试图把网页交互中原本隐含的规则显式说出来。它可能让重复性的查询、填写与导航更稳,也促使网站重新思考:哪些操作可以授权、如何说明后果、何时必须由人确认。
真正成熟的体验,不是代理替你做得越多越好,而是它在每一次越过重要边界前,都能让你看见、理解并决定。
参考来源
1. W3C Web Machine Learning Community Group,《WebMCP》草案(2026-07-28)
2. Chrome for Developers,《WebMCP》文档:能力、限制、权限与试验状态
3. Cloudflare Blog,《Give any website a WebMCP interface》(2026-08-06)
4. Cloudflare Blog,《Building an open Agentic Internet》(2026-08-06)
—推荐阅读—



