
为了达到这个目标
- 自创一个 outline 的修改格式 (也叫 `Markdown 版` 因为和 md 格式原理差不多)
主要是方便 多模态的 LLM 进行 OCR识别,按格式输出,,写入本软件,自行内部转换
- 增加 ”页码偏移/补充“,考虑 ocr 的页码数字,是 目录体系,和 pdf文件 不一定对应,,需要两个系统进行换算,,本软件,变更每次计算,为无脑输入,软件自己负责计算(个别问题 个别修改可)
- 增加”预览功能“,根据 页码偏移,,可在保存pdf前,及时预览效果(主要保证 目录体系 和 pdf 文件,主体正确)

---分割线---
markdown版 的修改格式:
也很简单,就是 #开头 标识层级,后面”标题“ 和 “页码” 用空格隔开
这样做的好处是,,LLM 偶然会多输出 空格,但不影响结果正确性(而 通行的 ”缩进版“ 麻烦就大了)
```
# Level1 p1
## Level2 p2
### Level3 p3
```
---分割线---
技术细节补充
本项目在的代码仓维护:github.com/fun-tailor/tool_pdf_outline_editor
- 主体来说,修改/编辑pdf目录,是两种格式,在本软件 右上角切换 (”缩进版“ 和 ”markdown版“)
- 此外,还支持解析 一个常见的 ”现成OCR格式“ (不支持编辑,需要转换为上两种格式)
支持解析形如 `页码 (p...): 标题` 的特殊目录格式(支持任意层级)。(#说明:这种往往随pdf文件提供,本软件提供解析支持,在`菜单栏` -> `导入` -> `导入 现成OCR版本`)
本软件 主要针对 扫描版书籍(往往缺乏目录),其他文件 往往都已经带目录,其次 OCR 原理虽简单,可也一般操作细节很多,格式易出错,计算页码偏移,最关键的 效率很低,本软件+多模态LLM,效率可以非常高 (未来准备加 API 的支持,选中 pdf 目录页的页码,一步生成)


夜雨聆风