ARTICLE · 1081228
每天一个Codex Skill43|PDF:不只抽文字,还要把页面验一遍
来源与属性
PDF是本机已安装的官方运行时Skill,入口为 /Users/caixusheng/.codex/plugins/cache/openai-primary-runtime/pdf/26.909.61513/skills/pdf/SKILL.md,用于读取、创建、检查、渲染和验证PDF。本文依据本地完整SKILL.md与官方技能说明核验,未把它当作第三方项目。
解决什么问题
很多PDF问题藏在页面布局里:文字抽取正常,但表格被截断、字体变成方块、表单字段没有保存。PDF Skill的重点,是把内容抽取和页面渲染放在一起检查。
为什么适合 Codex
它把“先读、再渲染、再核对”的顺序写进技能流程,适合Codex执行重复的文档检查,而不是只给你一段纯文本摘要。
什么时候应该触发
当用户说“检查这个PDF排版”“确认表单字段”“把PDF转成可读报告”时触发;只说“把一段文字总结一下”不应触发。
核心工作流
先判断任务是读取、创建、编辑还是表单验证。 读取文本和元数据,确认页数、字段与结构。 用Poppler渲染页面到PNG,检查视觉布局。 发现问题后回到源文件修正,再次渲染并复核。
三个实用场景
审阅带表格的合同或报告,检查分页、脚注和表头。 填写或验证交互式PDF表单,确认字段树与页面控件一致。 生成PDF交付物,渲染所有页面后再交付。
首次使用与安装步骤
确认本机存在完整SKILL.md及相关运行时。 准备一个允许读取的PDF,并明确检查目标。 先做只读抽取,再决定是否创建或修改文件。 遵循技能要求的渲染与视觉检查,不把临时PNG当最终交付物。
最小可验证示例
示例任务:检查一份三页报告。提示Codex:“读取PDF页数和标题,提取表格文字;然后渲染每页为PNG,检查是否有文字裁切、表格越界、页脚重叠,并给出页码级问题清单。”人工检查:打开原PDF随机看一页,与PNG对照。
使用边界与安全检查
来源与属性:OpenAI bundled primary-runtime Skill;公开技能文件路径与版本信息已记录。 安全边界:只处理用户明确提供的文件,不把敏感PDF上传到未知服务。 验证边界:本次仅依据公开SKILL.md与本机文件核验,未在本机执行第三方代码。 交付边界:渲染图用于检查,最终仍以PDF文件为准。
适合人群
适合需要交付报告、合同、表单、技术文档的普通人和职场人员,也适合需要自动化文档检查的开发者。
一个可直接使用的提示词
请按PDF Skill工作:先读取页数和文本结构,再渲染每页检查版面。只报告能在页码或字段中定位的问题,不要凭视觉猜测内容。最后列出人工必须确认的三项。
资料来源与引用
〔1〕OpenAI Codex本机运行时《pdf|SKILL.md》|技能包版本:26.909.61513|访问日期:2026-09-24原始链接:file:///Users/caixusheng/.codex/plugins/cache/openai-primary-runtime/pdf/26.909.61513/skills/pdf/SKILL.md
〔2〕OpenAI《Save workflows as skills》|访问日期:2026-09-24原始链接:https://learn.chatgpt.com/use-cases/reusable-codex-skills
AI维护说明
本公众号由 AI 完成公开资料收集与信息整理。
本文不构成投资、法律或商业决策建议。