ARTICLE · 1069727
PDF里的字选不中,一句话转成Word

一份别人发我的 PDF,二十多页,我想把其中两段话摘出来用。
选中,复制,粘进文档,空的。
我以为是自己手笨,换了台电脑,还是一样。鼠标按下去,整行整行地跳,跟按在一张图片上似的。
后来才知道这不怪文件。PDF 的初衷是“在谁的电脑上打开都长一个样”,所以它把每个字连同位置、字体一起钉死在页面上。它存的是样子,不是内容。你想从里面抠一段出来,跟从照片上抠字差不多。
以前碰到这种文件,我一般走三条路。
手打。这个我真干过,打到第三页就开始怀疑人生,末了还错了好几个字。
下软件,免费额度转两张就没了,转出来带着它自己的推广页,删都删不干净。
找小程序更折腾。先看十五秒广告,看完让你分享给两个好友,结果只给你一页。
三条路浪费的是同一样东西,时间。而且下次再碰到,还得从头浪费一遍。

这次换了个法子。没用软件,没看广告,也没分享给谁。
打开 WorkBuddy,把那个管 PDF 的技能装上,文件拖进去,说了一句话。等了几秒,一份干干净净的 Word 躺在那儿。
那些选不中的字,全都在。
1. 技能在哪儿装
WorkBuddy 左边那一列,找到「专家技能连接器」,点进去。
搜索框里打「腾讯文档 PDFKit」,装上。
装完回到对话。这一步我一开始漏了:在输入框左下方点那个「+」,选技能,把「腾讯文档 PDFKit」勾上。
技能装完不勾,等于没装。你发出去它还是照平常那样跟你聊,不会去动你的文件。我在这白等了一会儿,还以为坏了。

2. 文件怎么给它
PDF 直接拖进输入框就行,不用先传到哪儿,不用转格式,也不用管它多大。
然后跟它说这句话,原话抄:
帮我把这个 pdf 转换成 word 即可
要说“转换成 word”。我起先说的一句是“帮我提取文字”,它也照做了,但给的是一大坨挤在对话框里的字,还得自己排。换成要 Word,它就把文件整整齐齐转好,拿下来直接能用。
3. 转出来的是什么
一份 Word。原来的标题还是标题,段落还是段落,一级二级的编号一个没乱,标点也没变成方框。
我拿着对着原文件翻了一遍,正文没缺。
4. 有几种文件别指望
这招不是万能的,有几种情况我踩过。
扫描出来的那种,碰上了就头疼。拿扫描仪过一遍的、或者干脆拿手机拍下来的 PDF,里面根本没有“字”这层东西,只有一张张图。你让它转,它给你一片空白,或者认出来七零八落。这种得换一条路,让 AI 去认图上的字,错字会明显多,你必须自己通读一遍。
大标题做成图片的,会丢。有些 PDF 排得花哨,标题是拿图做的。正文都在,那几行标题没了,得自己补回去。
表格和公式,别抱太大希望。简单的表还凑合,复杂的表格会串行,公式基本就废了。
数字全部自己核一遍。金额、日期、编号这类,认错一个字符就是事故。我吃过这个亏。现在不管它转得多干净,这几项我都会对着原文数一遍。
还有一句得说明白:只弄你自己有权用的文件。自己买的、自己写的、公开的都行。别人付费的、内部传的,别往上传。
5. 然后是 html 那一步
Word 拿到手,是给你干活用的。改字、复制、存档,这些都够了。
但 Word 有个毛病。你在这台电脑上排得好好的,发给别人,对方手机上打开往往是乱的。字号变了,缩进跑了,编号自己重新数了一遍。
所以还有第二步。接着跟它说一句:
把它排成一份 HTML
它会先把手里的内容看一遍。哪句是标题、哪些段是正文、哪几条是并列的清单,认出来之后重新分好层级,再排成一份网页文件。
存下来,双击就能在浏览器里打开。标题有标题的字号,段落有段落的间距,编号不再自己乱数。发给谁打开都是同一个样子。
我自己是这么用的:内容先用 Word 拿稳,要往外发的时候,再让它排一份 html。两步加起来,还是一句话的事。

6. 省下的不只是那几十块
以前这道题的标准答案,是充个会员。
现在这道题的答案,是一句话。
省下来的不只是那几十块会员钱,还有你每次碰上这种文件都得重新折腾的那半小时。