批量 PDF 双层化工具（CPU RapidOCR 便携版）
================================================

用途
----
把文件夹中的单层/图片型 PDF 批量转换为可复制、可搜索的双层 PDF。
本版本只使用 CPU 推理，不需要 NVIDIA 显卡，也不会调用 TurboOCR/TensorRT。

使用方法
--------
1. 将整个 BatchLayeredPdfRapidCPU 文件夹解压到本地磁盘。
2. 双击 BatchLayeredPdfRapidCpuTool.exe。
3. 选择 PDF 文件夹和输出目录，然后点击“开始转换”。
4. 可以关闭后重新运行并勾选断点续跑；已严格验收且源文件未变化的任务会跳过。

生产保护
--------
- PDF 渲染、OCR、写入、验收均有超时和进程树清理。
- 预估磁盘空间，默认保留至少 10 GB；低空间会暂停并等待释放。
- 每份 PDF 最多自动重试 3 轮；最终异常文件写入失败清单和隔离记录。
- 输出必须可重新打开、页数一致，并达到 100% 文本层页面覆盖率才算成功。
- 中途强制关机后可重新启动并继续；当前未完成文件会重新处理。

输出报告
--------
输出目录\.docuagent-layered-pdf\reports\batch-result.json  总验收报告
输出目录\.docuagent-layered-pdf\reports\failures.csv       最终失败清单
输出目录\.docuagent-layered-pdf\quarantine\                异常隔离记录

CPU 调优（可选）
----------------
默认自动使用约一半逻辑处理器（接近物理核心数）。如需手工指定，在启动前设置：
DOCUAG_RAPIDOCR_CPU_THREADS=线程数

说明
----
CPU 版的目标是兼容无显卡电脑，不会比 RTX 5060 Ti 上的 TurboOCR GPU 版更快。
损坏、加密、权限受限或非标准 PDF 可能无法处理；程序会重试后明确隔离并报告，
最终目标是“所有文件成功，或者明确隔离并报告异常文件”。

内置组件
--------
RapidOCR 3.9.1（Apache-2.0）
ONNX Runtime 1.28.0（MIT）
默认模型：PP-OCRv6 det/rec small + PP-OCRv4 text direction classifier
