# 双层PDF

> 本地 OCR 把扫描件转为可搜索、可复制的双层 PDF，支持多语言识别与六种书签生成模式，全程本地推理不扣费。

- 分类：文件管理器
- 关键词：PDF、OCR、双层PDF、文字识别、可搜索、书签、扫描件
- 在线原文：https://www.xyltools.com/docs/pdf-dual-layer

---

## 功能简介

双层PDF 工具对扫描件、图片型 PDF 执行 OCR 文字识别，在原始页面图像下方叠加一层隐形文本——看起来和原文件完全一样，但可以搜索、选中和复制文字。同时支持自动生成书签目录，让大部头扫描文档也能快速跳转定位。

> **本地推理，不扣费**：OCR 识别完全在本机 CPU/GPU 上运行（窗口内会显示检测到的硬件信息），不调用在线服务，不消耗点数，文件也不会离开你的电脑。

## 入口位置

在文件管理器中选中一个或多个 PDF 文件，点击顶部工具栏"PDF工具"菜单，选择"双层PDF"。

## 操作步骤

1. **选择提取模式与识别模型**：提取模式默认"混合模式"（推荐，已有文本的页面直接复用、纯图像页才跑 OCR），也可选"整页强制 OCR"。识别模型默认"快速识别"，对精度要求高可切"高精度识别"（速度较慢）。
2. **选择识别语言**：默认"中英文混合"，另支持英文、日文、韩文、繁体中文。
3. **设置书签生成模式**：六种模式：不生成 / 按页码（默认）/ 智能识别标题（可预览编辑）/ 自定义内容匹配 / 按文件名批量 / 智能混合（可预览编辑）。选"自定义内容匹配"时可调整匹配阈值。
4. **选择输出位置并开始**：默认输出到源文件目录，也可选择覆盖源文件或自定义目录。点击开始后逐页识别并显示进度。

![双层PDF设置窗口](https://www.xyltools.com/docs/light/pdf-dual-layer-1.png)

## 参数说明

| 参数 | 选项 | 说明 |
| --- | --- | --- |
| 提取模式 | 混合模式（推荐默认）/ 整页强制 OCR | 混合模式保留已有文本层只补 OCR；强制模式全部重新识别 |
| 识别模型 | 快速识别（推荐默认）/ 高精度识别 | 高精度模型准确率更高但速度较慢 |
| 识别语言 | 中英文混合（默认）/ 英文 / 日文 / 韩文 / 繁体中文 | 按文档主要语言选择，选对语言可明显提升准确率 |
| 书签模式 | 不生成 / 按页码（默认）/ 智能识别标题 / 自定义内容匹配 / 按文件名批量 / 智能混合 | 智能识别与智能混合模式支持在生成前预览并手动编辑书签 |
| 匹配阈值 | 60（宽松）/ 70（推荐默认）/ 80（严格）/ 90（精确） | 仅"自定义内容匹配"模式显示，控制关键词匹配的严格程度 |
| 文件名清理规则 | 移除数字前缀 / 移除分隔符 / 智能大小写 / 自定义正则 | "按文件名批量"模式下用于把文件名清洗成干净的书签名，支持实时预览 |
| 输出位置 | 源文件目录（默认）/ 覆盖源文件 / 自定义目录 | 覆盖前请确认备份 |

## 使用技巧

> **给合同扫描件建立可检索档案**：把成批合同扫描件转成双层 PDF 并选"按文件名批量"生成书签，之后配合文件搜索就能直接按内容关键词找到具体文件和页码。

## 常见问题

> **识别速度与硬件相关**：本地 OCR 速度取决于电脑硬件，窗口会显示检测到的 CPU/GPU 信息。大文件首次运行需加载模型，稍慢属正常；后续文件会明显加快。

- 手写体、艺术字、低分辨率扫描件的识别准确率会下降，可尝试切换"高精度识别"模型。
- 双层 PDF 的文本层不改变页面外观，打印效果与原文件完全一致。
- 智能识别标题模式建议在预览窗口中校对一遍再确认，避免个别误识别的书签。

## 相关文章

---

## 相关文章

- [页面编辑](https://www.xyltools.com/docs/pdf-page-manager)
- [文档检索助手](https://www.xyltools.com/docs/doc-finder)
- [PDF压缩](https://www.xyltools.com/docs/pdf-compress)
