乐于分享
好东西不私藏

不用API、不写爬虫,我用一个插件让AI抓完了小红书数据

不用API、不写爬虫,我用一个插件让AI抓完了小红书数据

上周想调研小红书AI赛道,手动翻太慢。想起opencli,跟AI说了一句话,一晚上没怎么管,第二天起来报告就出来了:

爬了372篇小红书AI笔记,发现5个跟直觉完全相反的真相

有读者朋友问,小红书的数据怎么抓取的?

无需技术背景,不用手写爬虫,只用到了一个插件,然后AI接管抓取即可

上周五在懒人专属群里已经分享过方法了

群友们实测后反馈:

安装

这是大佬开源的项目,直接上手

首先,在谷歌浏览器上安装opencli这个插件

安装后,点击插件会有一个“链接码”

把下面这段话发给你的vibe coding工具,小懒用的是国产的Trae:

我已经在chrome浏览器安装了opencli插件,识别码是:XXXX(换成你的码)

你先连接一下opencli,opencli开源地址是:https://github.com/jackwener/opencli

opencli可以直接连接你电脑上已经打开的 Chrome 浏览器,复用你浏览器里已经登录的会话状态

翻译成人话:你在浏览器里登了小红书,opencli 就直接借用这个登录状态去操作

不需要 API Key,不需要 Token,不需要存任何凭证。你的账号信息永远留在浏览器里

实操

OpenCli之所以是神器,在于它多平台”通杀“

它支持155个网站适配器 + 13个外部CLI + 9个App适配器

这里就举小懒上篇文章用到的,利用它抓取小红书AI赛道的方法:

很简单,在 Trae 对话窗口里,正常说话就行,比如:

「帮我搜小红书'AI工具'前15篇笔记,导出JSON」

「抓一下这个账号主页的所有笔记列表:[URL]」

「这些笔记的收藏数和评论数也帮我抓一下」

「opencli 抓不到粉丝数,帮我用 browser 命令想办法」

最后这条是小懒说过的原话——AI 自己想了个办法,用 opencli 的浏览器操控功能打开账号主页,注入JS提取粉丝数,搞定了。

你不需要知道有哪些命令,AI 知道。你只需要说目标。

所以Opencli不只是一堆固定命令,它是一个能被 AI 灵活调用的"万能遥控器"。 命令不够用的时候,AI 自己想办法绕

甚至数据爬取完之后,都可以让AI帮你整理分析,直接做成精美的html

注意事项

虽然用的是我们自己的账号权限,接管了浏览器进行操作,还是有必要强调几点:

1 延时风控,你大规模批量抓取,容易被后台识别到机器人爬虫,所以让AI抓取的时候,强调一下“模拟真人”操作(最好用个小号),以免被封号

2 除了浏览器,opencli还可以控制很多软件,但这些软件大部分是macOS平台上的。这块兴趣的话自己去扩展

反正OpenCli支持的平台很多,小懒给群友们做的懒人情报站就是利用这个工具,到十几个资讯平台筛选,抓取,判断后得到的情报

正如上周五小懒给群友们“布置的作业”,大家可以结合自己的行业,抓取一些相关的站点内容,做成数据分析报告,或者沉淀为自己的知识库资产

更多AI工具实测和工作流,我会持续在这个号更新。如果你也在用opencli,欢迎评论区聊聊你的用法

推荐阅读

爬了372篇小红书AI笔记,发现5个跟直觉完全相反的真相

扒了卡兹克676篇文章,拆出头部AI号3年零回调的3个规律

我爬了刘小排221篇文章,发现Claude Code垂直号的3个反直觉真相

AI头部大号337篇文章的数据告诉我:80%的人都在做错选题

我拆了2711篇文章,发现低粉爆款的破圈公式