夜雨聆风学习资料网

ARTICLE · 1070745

不逆向微信、不封号,我给微信加 AI聊天助手——一个 Java 老兵被职场逼急之后的 4 小时自救

不逆向微信、不封号,我给微信加 AI聊天助手——一个 Java 老兵被职场逼急之后的 4 小时自救

全文约 3000 字,读完约 5 站地铁。这不是一篇技术教程,是一次真实的自救:在银行对接群里说错一句话就是你的锅,于是我花一个下午,把「让 AI 帮我说话」这件事本身给自动化了。

今天在群里看到一段话,我盯着看了三十秒。

「假如你是唯一一个能把工作干明白、并且工作进度正常的人。

这个时候,你得到的并不会是同事的敬佩,或者领导的赞扬。而是一帮啥都整不明白的半吊子,围着你挑你工作的毛病。

你很快就会变成唯一一个努力干活的人,不管你们部门有多少人。

更更恐怖的是,你领导会从各个消息来源总结,认为你活少,接着给你安排更多的活,甚至会把其他『笨蛋』员工的工作安排给你。」

我之所以盯着看,是因为我就是那个人。

做网关 10 年,42 家银行的对接是我一手跑通的。结果是:银行有问题找我,平台有问题找我,联调卡住了也照样找我。而那些连报文格式都看不懂的人,负责在群里挑我的措辞毛病。

于是今天下午,我干了一件不太「努力」的事——花 4 个小时,给微信装了个 AI 嘴替。

一、在对接群里,说错一句话就是你的锅

先说说我的日常。今天上午,我在银行对接群里问了四个问题:

① 文件上传通知接口里的文件序号,到底是从 0 开始还是从 1 开始?

② 日志报 PRECONDITION_FAILED - unknown delivery tag 4,该怎么排查?

③ ptbh 平台编号的参数现在能配吗?如果暂时配不上,大概什么时候能配?

④ A业务和B业务,能不能共用同一套密钥?

这四个问题的共同点是:每一个都牵扯三方——我们、银行、平台研发。说重了得罪人,说轻了没人理,说含糊了出问题算你的。

就拿「能不能共用密钥」来说。第一版我打的是「你们这个密钥有点麻烦,能不能共用」——删了。第二版「建议共用同一套密钥」——太硬,删了。第三版……在输入框里删删改改五分钟,最后发出去那句,我自己都不满意。

一句话值五分钟,一天十几次。我一天里最累的不是写代码,是措辞。

二、第一版解法:把 AI 当枪手,然后发现更累

我的第一反应跟多数人一样——去问豆包。我把问题贴进去,它给了我四个版本,其中一个长这样:

「老师,我们这边希望A业务和B业务共用同一套密钥,方便统一维护管理,减少多套密钥带来的运维成本与出错风险。麻烦确认下是否支持该方案,谢谢!」

——干净、专业、不卑不亢,比我憋五分钟憋出来的强。

问题解决了吗?没有。因为流程太长了:

切窗口 → 复制对方的话 → 描述我的意图 → 等生成 → 挑一个 → 复制回来 → 切回微信 → 粘贴 → 再改一遍称呼。九步。

一天来十几次,每次两分钟,光「切换窗口」这一件事就吃掉半小时。更要命的是,切过去再切回来,思路也跟着断了。

盯着那段流程,我突然意识到一件事:「让 AI 帮我说话」这件事本身,才是最该被自动化的那件事。

三、4 小时,我给自己写了个「嘴替」

下午 4 点多开工,晚上 8 点多收工。中间还包括把界面推倒重做两遍、修一个诡异的边框 bug。真实时间线(来自运行日志):

时间

发生了什么

16:28

项目初始化,定技术路线

17:18

三个核心模块写完(捕获 / 调用 / 回填)

17:38

热键终于不报错了

18:13

第一次跑通全流程:唤起 → 生成 → 一键回填微信

18:50

UI 推倒重做成深蓝科技风

20:19

加完人格配置(系统提示词)

最终的效果是这样的:在微信输入框里打好草稿(或者什么都不打),按下 Ctrl+Alt+P —— 程序自动读取当前聊天最近 5 条消息作为上下文,调用大模型生成 3 个版本,弹出一个深蓝科技风的小窗。点「发送」,它自动把文本回填到微信输入框并粘贴好,你只需要按一下回车。

九步,压缩成一步。

实际用起来是什么样?我截了几张图。

① 首次使用,先填大模型 API Key

图 1:首次运行会引导填写大模型的 API Key,填完保存即可使用

填完点保存,屏幕右下角会出现一个朝你招手的小机器人。

图 2:右下角状态机器人,招手表示空闲待命

鼠标点一下这个小机器人,就会触发 AI 润色请求;它随即变成「正在敲电脑」的状态,表示正在处理。

② 用 AI 润色自己的表达

图 3:写好草稿后唤起 AI 润色,一次给出多个版本供挑选

③ 对方说的话实在让人无语,就让 AI 帮你想一个回答

图 4:直接针对对方的原话生成回复,省掉自己组织语言的过程

四、关键决策:为什么不做「微信插件」

想做这件事,第一个诱惑是:找个微信机器人框架,hook 进去,自动收消息、自动回。

我没做。原因很简单:个人微信没有官方开放 API,市面上的方案(WeChaty、iPad 协议)本质都是逆向协议,违反微信 ToS,封号风险是实打实的。我这个号养了这么多年,不值得为省两分钟冒这个险。

最后走的是合规路线:剪贴板 + Windows UI Automation。说人话就是——它不碰微信的任何内部协议,只是帮你按 Ctrl+C 和 Ctrl+V。

技术选型很朴素,全是成熟件:

text

pynput→ 全局热键监听

uiautomation→ 读取微信当前聊天最近 N 条消息

pyperclip→ 剪贴板读写(不破坏你原来的内容)

tkinter→ 浮动选择窗

Pillow→ 右下角状态动图(1.webp 空闲 / 2.webp 处理中)

DeepSeek→ OpenAI 兼容接口,改 api_base 一行就能切豆包 / GPT

成本:API 调用一次几分钱,整个项目不到 400 行 Python。

顺带一个意外收获:因为它只操作剪贴板和窗口控件,所以不只服务于微信——飞书、钉钉,甚至浏览器里的输入框,按热键一样能用。

五、它怎么工作 + 合规与隐私

技术路线讲完了,接下来回答大家最关心的两个问题。

Q1:会不会被微信封号?

不会。

因为我完全不碰微信的协议:不改客户端、不注入进程,也不会自动替你发消息。

它只做一件事——替你按 Ctrl+A、Ctrl+C、Ctrl+V,和你自己敲键盘一模一样。

Q2:我的聊天记录会不会被传出去?

不会。

截图和文字识别,全部在你自己的电脑上完成,不上传、不存盘。

真正发到外面的,只有你要润色的那句话,以及从聊天里读出来的上下文。而且是发到你自己填的那个 AI 账号里,不经过任何第三方服务器。

六、意外收获:一套代码,多种人格

晚上 8 点 19 分那次提交,我加家里ai系统提示词设置功能,是多套人格配置——同一份代码,按鼠标滚轮键弹出设置页面,换个提示词,说话方式就完全不一样。

图 5:三套人格配置,切换的只是提示词,代码一行没改

以后再有人跟你说「提示词工程不是技术」,你就把这个例子甩给他:在 Agent 时代,提示词就是配置文件,配置文件就是人格。这跟我们写银行网关时把路由规则从代码里挪到注解上,是同一件事。

七、回到开头那段话

「活干得越好,活越多」这个困局,靠更努力是解不开的——你越能干,摊子越大,最后被无穷无尽的琐碎沟通淹死,连写代码的时间都没有。

但有一件事是能改的:把重复劳动交给工具。

我今天花的 4 小时,买的不是这个程序,是以后每一天里那半小时的措辞时间。更重要的是,它把我从「反复斟酌一句话」的精神内耗里捞了出来——那才是真正耗人的东西。

工具不能替你背锅,也不能替你把那 42 家银行再跑一遍。但它可以替你想好:这句话,该怎么说。

写了 10 年 Java,我最大的体会是:所谓架构能力,本质是识别什么是重复的,然后把它抽出来。这个道理,用在工作流上,比用在代码上更值钱。

聊两句:

① 你有没有过「活干得越好、活越多」的时刻?

② 如果给微信装个 AI 嘴替,你最想让它替你说哪句话?

评论区聊聊,翻车现场最精彩。

评论区发送「程序」,即可免费获取。

探员 · 写了 10 年 Java,正在 AI Agent 转型路上。每周更新,只写自己踩过坑的内容。

相关学习资料