PDF拆分
约 906 字大约 3 分钟
1. 官网入口
MaoKit-PDF拆分
按页数或关键词拆分 PDF,或提取指定页面
2. 功能简介
批量拆分PDF,支持以下两种处理方式:
按规则拆分:按页数或关键词将 PDF 切成多份。
按页数拆分:每 N 页切分为一份。
按关键词拆分:遇到命中关键词的页面时,从该页开始切分为新的一份。
提取指定页:只导出目标页段,其余页面丢弃。
按页码:导出指定页码(如
1,3,5-7)。按关键词:导出命中关键词的页面,可一并追加其后若干页。
说明
本工具在拆分PDF时,会动态调用毛燕庆开发的智能解析算法,并完全在本地运行,不会将文件上传至云端。
3. 操作步骤
3.1. 步骤1:点击或拖放文件
点击上传区域选择 PDF,或将 PDF 文件直接拖放至上传区域。导入后本工具会自动解析每个文件的总页数,并按当前规则预估输出份数(关键词模式在处理前无法预估)。

3.2. 步骤2:设置处理方式与规则
点击工具栏的 设置 按钮,在“处理方式”卡片选择“按规则拆分”或“提取指定页”,并在下方规则卡片配置具体规则。
3.2.1. 按规则拆分
“拆分方式”可选“按页数拆分”或“按关键词拆分”:
- 按关键词拆分:通过关键词规则编辑器设置匹配规则;遇到命中关键词的页面时,从该页开始切分为新的一份。

- 按页数拆分:设置“每份文件页数”,按该页数顺序切分。

3.2.2. 提取指定页
“提取方式”可选“按页码”或“按关键词”:
- 按页码:在“指定页”输入要提取的页码,支持
1,3,5-7这样的逗号分隔与区间写法。

- 按关键词:设置关键词规则,并可选“命中后追加页数”,导出命中页及其后若干页。

关键词识别
“按关键词”模式会对 PDF 逐页识别文本以匹配关键词:纯文字 PDF 直接提取文本;含扫描页的 PDF 需要本地 OCR 识别(首次使用需下载模型与运行时)。若 OCR 资源不可用,含扫描页的文件将无法识别关键词,纯文字 PDF 不受影响。
3.3. 步骤3:拆分/提取页面
确认规则无误后,点击工具栏的 拆分页面 或 提取页面 按钮(按当前处理方式显示),本工具会将所有未排除文件的结果打包为一个 ZIP 下载(MaoKit_PDF拆分_<时间>.zip,内含按页段命名的各结果 PDF)。

3.4. 结果示例
4. 功能特性
4.1. 排除/恢复
排除:在列表右侧的“操作”列中,点击 按钮,即可将之排除,处理时跳过该文件。
恢复:在列表右侧的“操作”列中,点击 按钮,即可将之恢复。

4.2. 配置自动保存
处理方式、拆分/提取规则、页码、关键词等设置会自动保存到本地,下次进入页面时自动恢复,无需重复配置。