夜雨聆风学习资料网

ARTICLE · 1137836

你网站的搜索数据可以直接问 AI 助手

你网站的搜索数据可以直接问 AI 助手

网站挂上去之后,麻烦就换了一种。

建站时的问题都很具体,用什么模板、放哪台服务器、域名怎么解析。上线之后问题变得模糊,它在搜索里到底什么状况,有没有人搜得到,为什么某天多了一百个访问,之后又没了。

你知道该去看 Search Console。真打开是十几张表,查询词、页面、国家、设备、日期,还能互相交叉着筛。你心里想问的其实只有一句,「我接下来该写点什么」,那张表不回答这个。

SEOMonster 走的是另一条路。它不给你一个新面板,而是把这份数据接到你平时就在用的 AI 助手里,你想问什么,直接用大白话问。

它是个装进 AI 助手的小服务

装完之后,你的 AI 助手启动它,它拿你自己的 Google 授权去取数,整理成同一套格式,再交回给助手,由助手用人话讲给你听。整个链路都在你自己的机器上跑,凭据也是你自己的。

它认的宿主是 Claude Desktop、Claude Code、Cursor、Cline、Codex。安装有两条路,一条是图形化的包,一条是一行命令。

装上什么都不配,它先把家底报给你

我什么都没配,先问了一句系统状态。它回的就是下面这个。

十一个服务一个一个列过去,能用的、没配的、为什么没配,全写清楚了。GA4 那条直接给了一句没配置 Google 授权,destructive_enabled 那一栏是 false。

它没有因为缺凭据就崩掉或者装死,而是把「我还缺什么」当成一种正常输出来给你。

有三个服务不用配任何东西

上面那张图里,psi、crux、technical 三条是 configured: true。

技术检查那一组完全不碰你的账号,就是拿一个网址去查公开页面:标题和描述、canonical、重定向链、页面里的混合内容引用、robots.txt、站点地图、结构化数据、站内链接。这些不需要授权,随便一个网址都能跑。

页面体验和真实用户指标走的是公开接口,匿名也能用。作者在文档里提醒过一句,匿名额度是所有匿名调用方共用的,经常被打满,别把它当常态。

顺手交代一个门槛:上面那些检查随便什么网址都能跑,但要查到自己的搜索数据,你得有 Google 账号,站点也得已经在 Search Console 里。

能查的东西比你想的宽

七十个工具,按服务分成十一组。

Search Console 那组最厚。曝光、点击、点击率、排名可以不限维度地拆;两个时间段直接对比出涨了跌了;一批网址丢进去批量看收录裁定;拿站点地图给的清单跑一遍覆盖率审计。

GA4 那组管流量和转化,哪个落地页带来的人最后真的成交了。

Cloudflare 那组管边缘:DNS、缓存、重定向规则、SSL 和 HSTS 这些设置,外加一份设置体检。

IndexNow 那组是通知 Bing、Yandex 这些引擎,告诉它们某个页面更新了。

剩下的是关键词发现、内容、结构化数据、站内链接这几类。

它除了单个工具,还预置了一批现成的流程,比如发版之后该怎么验收、每周该盯哪几个数、站点迁移时怎么一步步核对。

它最有用的一类回答,是「你还差一点」

「我现在怎么样」这种问题,任何后台都能回答。更值钱的是另一个问题,哪些词我已经排在第 8 到第 20 名,而且确实有人在搜。

那个位置离首页只差几名,需求又真实存在,是最值得花力气的地方。它把这些查询按机会大小排好,顺带标出互相抢排名的页面。想要更具体一点,它还能给一份写作前的资料,把排名靠前的那些页面抓下来,告诉你它们都有哪些小标题、篇幅大概在什么水平、覆盖了哪些概念。

它只给证据和规则,不替你把文章写出来。

它报数字,也报「这次改动到底有没有用」

这是我在这份文档里最喜欢的一段。

你改了个标题,动了个结构,两周后流量动了。这是你的功劳,还是本来就该动?大部分工具只能给你一张前后对比的曲线,然后你自己判断。

它用的是对照组:找一个条件接近的页面群,在同一个时间窗里一起比,最后给出一个估计提升值和 95% 置信区间,再落成三种结论之一,涨了、跌了、看不出来。旁边还有一栏专门列混杂因素,会自动认出搜索数据历史上那几次口径变化,并把受影响的指标降级。

最要紧的是它自己写的那句,这是观察,不是因果。要证明因果只有服务端做分流实验,它做不到。

它也管 AI 那边有没有提你

还有很大一部分流量发生在搜索结果页之外。有人在 ChatGPT 或者 Perplexity 里问了一个跟你业务有关的问题,回答里提了谁,你是不知道的。

有一组工具专门管这件事:采样一组你关心的提问,看几个 AI 引擎各自提没提你的品牌、提的是你还是同行,算出一个声音份额。

它的免责声明同样实在。单次跑没有任何统计意义,所以默认每个提问采七次,给的是份额和波动范围。它还明说开发者接口返回的内容和登录后看到的界面不一样,这个差异不藏。

另一个工具是查你这页写得方不方便被 AI 引用。它第一件事不是看结构化数据,而是看渲染盲区:几个主流 AI 爬虫能拿到 HTML,但不会执行 JavaScript,整站客户端渲染的站点在它们眼里就是一片空白。至于结构化标记、FAQ、llms.txt 这些常被吹的招,它明确说不给它们计分,理由是现有证据不支持这些能提高被引用的概率。

危险的动作,默认全是关的

读一直是开着的,写分了三档。

两个常规的写是默认可用的,提交站点地图、请求重新抓取,这两个影响面小。

清缓存这一类默认关着,得手动打开一个开关才响应,关着的时候它连网络请求都不发出去。

最狠的那个,把整个域名的缓存清光,还要多一步:你得把域名原样打回来当确认,打错或者不打,它就拒绝执行。

作者拿自己的站点跑了一天

上面那张表来自官网。作者自己运营着一批网站,全都用这个工具管,表里是某一天它实际干的五件事,每一件都写了调了哪些工具、结果是什么。原文最后一句是,这里没有一样是摆拍的。

关掉一个域名上 HSTS 的缺口,先干跑看了一遍前后差异,确认没问题才应用。把一张用 meta refresh 跳转的旧页面换成真正的 301,动手之前先把现有规则列出来,确保不覆盖别人的设置。给两个新的站点做上线,站点地图提交完请求抓取,十九个地址全部接受。发过两次版本之后清边缘缓存,每一次都要把域名打回来当确认。

第五件不太好看:他们自己的一个产品站没进 Google。检查下来技术项全部通过,问题出在 URL 检查显示「已抓取,未编入索引」,而且隔了很久都没有再抓过。结论是结构性的,不是某个标签写错了。

它把自己做不到的地方也写出来了

顺着上面的思路,这份文档里还有一串类似的句子,全是主动交代短板的。

匿名额度经常被打满,别当常态。用服务账号那条路虽然写在文档里,但没有拿真实项目独立验证过,遇到问题欢迎开单。小站点做真实用户指标会返回没有数据,而不是硬凑一个出来。Search Console 隐藏了大约四分之三的查询,所以它挑出来的新词只能算有依据的假设,不是结论。AI 流量天然少算,因为很多来源被记成了直接访问。

还有一份更新日志能看出作者怎么处理事故。某一版之后,所有新装的用户都会遇到服务起不来,宿主那边只报一句连接被关闭。原因是有个依赖发了大版本,把注册接口删掉了。作者把整件事写进了日志,包括影响哪些安装方式、哪种安装方式不受影响。

为什么非得先在终端里授权一次

这是文档里少数几条反直觉、但解释得很清楚的东西。

图形化包里的授权流程,是在 AI 助手的子进程里跑的。那个环境对每一次工具调用有几十秒的超时,而真人走完浏览器授权不可能这么快。于是第一次调用超时,之后每一次也超时。

它的做法是把授权拆出来单独做:在终端里跑一次,令牌落到磁盘上,之后服务只读缓存、静默刷新,再也不去开浏览器。

这个坑它没有藏,写在安装步骤的第二步里。

怎么装

最省事的是 Claude Desktop。去 GitHub 的 release 页把那个包下载下来双击,填一个表单,把扩展打开,重启一下。表单里哪些字段是敏感的它都标了,敏感的值进系统钥匙串,不留在配置文件里。

其他宿主就用一行命令加一段 JSON,Cursor、Cline、Codex 都是这个路子。凭据可以手写配置文件,也可以跑一次它的配置向导,让它交互式地问你,顺手把能验的都验一遍。

用之前先记住三件事

第一,装完先让它自报状态。看一眼哪些服务已经能用、哪些还要补,比直接开问省事得多。

第二,别急着打开那个开关。只读的部分先跑熟,清楚它读的是什么、吐出来的是什么,再决定要不要让它动手。

第三,它的输出本来就是给 AI 读的,别自己对着那堆字段较劲。让它解释给你听,那才是它设计出来的用法。

仓库与协议

https://github.com/avansaber/seo-monster,MIT 协议。

往期推荐

你上一次打开后台去看网站的数据,是什么时候?评论区聊聊。

相关学习资料