夜雨聆风学习资料网

ARTICLE · 1147606

100 页长 PDF,我用 AI 浓缩成一张信息卡片

100 页长 PDF,我用 AI 浓缩成一张信息卡片

上周收到一份行业报告,100 页出头。

我习惯性从第一页开始读。读到第 12 页,发现自己已经在看手机了。往回翻,第 8 页讲什么,完全没印象。

这不是第一次了。

问题不在我不专心。100 页的报告,前 20 页是背景介绍,中间 60 页是数据和图表,真正有用的结论散在最后 10 页里。你想省事直接翻到最后,可那些数据是结论的支撑,不看又怕漏掉前提。

于是要么硬啃,要么放弃。

我大多数时候是放弃。收藏了,然后再也没点开过。收藏夹里这样的文件,我数了下,不止一份。

更麻烦的是那种半途而废。有一份我硬读到了第 40 页,中间接了个电话,回来就再也接不上了,前面读进去的东西像被清空了一样。后来那份文件我放到现在都没打开过。

我想说的是,读长文件失败,一般不是意志力的问题,是方法的问题。你拿读一本闲书的姿势,去处理一份结构松散的资料,怎么读都别扭。

后来我换了个做法:不让它当一本“书”读,让它当一份“资料”拆。

我要的不是读完它,是拿到它里面那几条能用的东西。

这是两回事。读书的默认目标是通读,读不完就等于失败。拆资料的默认目标是取用,你只拿走自己需要的那部分,剩下的留着,不影响。目标一换,100 页就不再是压力,只是还没拆的原料。

先把文件喂进去

这一步没什么技术含量,但有个坑得说:别截图,直接传文件。

我一开始图省事,截了几张关键页的图发过去。结果它只能看到我截的那几张,我做卡片的时候,它一直在问我前面的数据在哪。

截图等于我替它做了一次筛选。那我干嘛不直接让它自己看。

传文件的方式看你用什么工具。有些 App 支持直接传 PDF 附件,有些要先把 PDF 里的文字复制出来贴过去。这一步各家不一样,你用哪个就按哪个来,没有通用答案。

还有个更省事的办法,如果你手上的文件里,真正跟你眼下的事相关的只有其中一部分,那你可以只把那一部分传过去。比如一份 100 页的行业报告,我可能只关心其中讲某一块市场的十几页,那就把那几页单独拿出来。

这里的分界线是这样的:你想让它替你通读全文,就别截图;你只想让它处理你圈定的几页,单独拿出来完全可以。

多数时候我还是建议整份传。因为你不知道自己漏掉了什么,让它先通读一遍,再决定哪些值得细看,比你自己提前判断要稳。

如果你的 PDF 是扫描件,也就是整页都是图片、鼠标选中不了文字,那得先转成能选字的格式,不然它读不进去。这个用系统自带的或者网页上的转换工具都能做,转完先自己拉一下文字,确认是能选的,再传。

再说文件太大怎么办。

我知道你的文件可能有几十上百页。传之前先看一眼大小,太大就拆成两三份,分次传。但拆的时候按章节拆,别从中间硬切。一份报告,摘要和第一章是有连带的,你从第 47 页一刀下去,两头都读不完整,它抽出来的东西容易读岔。

我一般会先看目录,把有独立标题的章节挑出来,一份一份传。麻烦一点,但后面省事。

分次传要注意一件事:每一份传完,让它单独抽一遍骨架,最后你再把几份的骨架合到一起。别指望它记住上一份的内容,它是分次读的,中间接不上很正常。合的时候我来,把重复的合并、前后矛盾的挑出来,这一步不值得交给它。

再让它抽骨架

这一步是关键。

我用的是一条挺笨但很管用的话术:

这是一份 PDF。请你只做一件事:把它里面最核心的观点、数据、结论抽出来,列成条目。抽的时候守着几条规则:一,不要复述原文的修饰和铺陈,只要能被引用的干货;二,每一条都标清楚它在原文的位置(第几页或哪个章节);三,不确定或者原文表述模糊的,标“待确认”,不要自己补全;四,最多给我 15 条,多的你自己判断哪些更关键。

这里面最重要的三个设计是“标位置”“待确认”和“最多15条”。

标位置,是让你回头能查证。它抽出来的每一条,你都能翻回原文看上下文,不至于被它一句概括带偏。

待确认,是给它留一个诚实的出口。这一点我一开始没加,后来吃了亏。它默认的写法是把所有东西都说得挺肯定,原文里那句“在某种假设下”“样本量有限”它常常就抹掉了。你让它标“待确认”,等于提前告诉它:不确定的可以说不确定,不用替我圆。这样出来的表,有几条挂着“待确认”,反而是好现象,说明它没瞎补。

最多15条,是逼它做判断。你不限制条数,它会老老实实把每一页的要点都列一遍,二三十条甩给你,那等于没抽,只是换了个地方堆。

它第一次给我回了一张表,15 条,每条后面带着页码。我扫了一眼就愣了一下,第 7 条我记得原文写得比这复杂得多。翻回去一对,果然有个限定条件被它省掉了,那一句的语气比原文肯定了不少。

我把它指出来,它补上了。

这个来回的过程,你也会遇到。它第一次交的东西,八成要返工一次。别嫌烦,你多问一句,它就多给一层。

最后把它压成一张卡片

拿到骨架之后,我让这 15 条再压一遍,做成一张卡片。话术是这样:

现在把这 15 条整理成一张信息卡片,结构是:一句话总标题、三到五个分块、每个分块下面两到三条要点。每个要点控制在一句话以内,要能一眼看懂。数据保留,修饰全删。

它给我的是一段带层级的文字。我再让它按这个结构画成一张图,或者我自己把这几个分块排到一张 A4 上,打印出来贴显示器边上。

我自己的卡片一般长这样:顶上一行总标题,一句话说清这份东西讲的是什么。下面横着切三四块,每块一个小标题。块里是两三条要点,要点下面挂一个页码,方便我回头翻。

最后那行页码很关键。卡片是给你自己看的,不是给别人看的,留着页码,它就从“一张图”变回“一份能追溯到原文的材料”。

原来 100 页的东西,最后留在我面前的,是一张扫一眼就能看完的卡片。

几个我踩过的坑

一,别一次让它做太多事。我试过一句话让它“读完、抽要点、做卡片、再翻译成大白话”。它做了,但每件事都做得潦草。分开做,每一步做完你看一眼,不对就让它调,再往下走。做卡片这事,慢就是快。

二,它抽的要点,你得抽查。它不撒谎,但它会省。原文里“在特定条件下”这五个字,它概括的时候经常就没了。这种省略不会让它写错,但会让结论显得比实际更绝对。

我一般会挑三条翻回原文核对,尤其挑带数字的那几条。数字最容易在压缩里变形,也最容易被你直接拿去用。

具体怎么挑,我有个偷懒的办法:专挑那些看起来特别笃定的句子。它写得越绝对,我越要翻回去看一眼原文。真正严谨的报告,结论里多半带着限定,它给你一句干脆的,八成是把限定省略了。

还有个小动作挺有用。你翻回去核对的时候,顺手把原文那一小段复制下来,贴在要点旁边。这样过一阵子你再看这张卡片,不用再翻原文件,上下文就在手边上。我一般只给最关键的几条做这个,全做太费劲。

三,卡片的用途想清楚。我做卡片是为了自己偶尔回顾,那结构越简单越好,能扫一眼看完就行。

如果你是拿去做汇报,那得换个排法。按原文逻辑排出来的卡片,自己看没问题,往会上一放,别人抓不住重点。这种时候我会让它按汇报结构重排,话术是这样:

把这份要点按“背景、现状、问题、建议”的结构重排一遍,每一块只留三条最关键的,每条前面加一句自己的判断,说明这条为什么值得关注。

同一个骨架,用途不同,最后那张卡长得完全不一样。你动手之前先想清楚给谁看,能少返工一次。

这三个坑说到底是一件事:别把它当自动售货机,投一个文件进去就等着出成品。它更像一个手很快的助手,你得盯着、得问、得返工,成品才是你的。

最后说两句实在的

AI 能帮你把 100 页压成一张卡片,但它替不了你判断哪一条重要。它给你的是一份筛选过的材料,不是结论。这份材料里哪条对你眼下的事有用,还得你自己看。

而且有一点必须提醒:如果这份 PDF 涉及公司内部资料、客户信息、还没公开的数据,别随便传给 AI。

这类内容一旦传出去,就不受你控制了。公开的报告、行业白皮书、自己能拿到但不算机密的材料,这些没问题。内部的东西,先问清楚再说。

我的做法是,公开资料直接拆。涉及具体项目和人名的部分,我自己先看一遍,只把需要它帮忙整理的那部分给它,其余的自己消化。

现在就做一件事:翻一下你的收藏夹,找一份收藏了但一直没看完的 PDF,把上面第一条话术复制过去,先让它抽 15 条骨架。五分钟的事。你看完那张表,大概就知道这份文件值不值得花时间了。值,再往下做卡片;不值,直接删收藏,也算给它个交代。

相关学习资料