夜雨聆风学习资料网

ARTICLE · 1081228

每天一个Codex Skill43|PDF:不只抽文字,还要把页面验一遍

每天一个Codex Skill43|PDF:不只抽文字,还要把页面验一遍

来源与属性

PDF是本机已安装的官方运行时Skill,入口为 /Users/caixusheng/.codex/plugins/cache/openai-primary-runtime/pdf/26.909.61513/skills/pdf/SKILL.md,用于读取、创建、检查、渲染和验证PDF。本文依据本地完整SKILL.md与官方技能说明核验,未把它当作第三方项目。

解决什么问题

很多PDF问题藏在页面布局里:文字抽取正常,但表格被截断、字体变成方块、表单字段没有保存。PDF Skill的重点,是把内容抽取和页面渲染放在一起检查。

为什么适合 Codex

它把“先读、再渲染、再核对”的顺序写进技能流程,适合Codex执行重复的文档检查,而不是只给你一段纯文本摘要。

什么时候应该触发

当用户说“检查这个PDF排版”“确认表单字段”“把PDF转成可读报告”时触发;只说“把一段文字总结一下”不应触发。

核心工作流

  1. 先判断任务是读取、创建、编辑还是表单验证。
  2. 读取文本和元数据,确认页数、字段与结构。
  3. 用Poppler渲染页面到PNG,检查视觉布局。
  4. 发现问题后回到源文件修正,再次渲染并复核。

三个实用场景

  • 审阅带表格的合同或报告,检查分页、脚注和表头。
  • 填写或验证交互式PDF表单,确认字段树与页面控件一致。
  • 生成PDF交付物,渲染所有页面后再交付。

首次使用与安装步骤

  1. 确认本机存在完整SKILL.md及相关运行时。
  2. 准备一个允许读取的PDF,并明确检查目标。
  3. 先做只读抽取,再决定是否创建或修改文件。
  4. 遵循技能要求的渲染与视觉检查,不把临时PNG当最终交付物。

最小可验证示例

示例任务:检查一份三页报告。提示Codex:“读取PDF页数和标题,提取表格文字;然后渲染每页为PNG,检查是否有文字裁切、表格越界、页脚重叠,并给出页码级问题清单。”人工检查:打开原PDF随机看一页,与PNG对照。

使用边界与安全检查

  • 来源与属性:OpenAI bundled primary-runtime Skill;公开技能文件路径与版本信息已记录。
  • 安全边界:只处理用户明确提供的文件,不把敏感PDF上传到未知服务。
  • 验证边界:本次仅依据公开SKILL.md与本机文件核验,未在本机执行第三方代码。
  • 交付边界:渲染图用于检查,最终仍以PDF文件为准。

适合人群

适合需要交付报告、合同、表单、技术文档的普通人和职场人员,也适合需要自动化文档检查的开发者。

一个可直接使用的提示词

请按PDF Skill工作:先读取页数和文本结构,再渲染每页检查版面。只报告能在页码或字段中定位的问题,不要凭视觉猜测内容。最后列出人工必须确认的三项。

资料来源与引用

〔1〕OpenAI Codex本机运行时《pdf|SKILL.md》|技能包版本:26.909.61513|访问日期:2026-09-24原始链接:file:///Users/caixusheng/.codex/plugins/cache/openai-primary-runtime/pdf/26.909.61513/skills/pdf/SKILL.md

〔2〕OpenAI《Save workflows as skills》|访问日期:2026-09-24原始链接:https://learn.chatgpt.com/use-cases/reusable-codex-skills

AI维护说明

本公众号由 AI 完成公开资料收集与信息整理。

本文不构成投资、法律或商业决策建议。

相关学习资料