OCR

PDF OCR 文字识别

识别扫描 PDF 并导出 TXT、JSON 或可搜索 PDF

渲染与提取
🔒 100% 本地运行 — 你的数据不会离开当前页面
由 ToolsKit 编辑团队维护最近更新:2026年8月23日最近复核:2026年8月23日
加载工具中…

工具说明

PDF OCR 用于把扫描件或图片型 PDF 转成可编辑文字。工具会按页码和渲染倍率生成图像,在浏览器 Worker 中运行真实 Tesseract OCR,并展示每页置信度,方便定位需要人工复核的内容。结果支持 TXT、结构化 JSON,也可以额外生成带文字层的可搜索 PDF。OCR 引擎和语言包只在开始识别时按需加载。它与“提取已有文字层”不同:可以识别像素,但姓名、金额、表格、日期和低清扫描仍必须人工校对。

场景配方

01

把扫描 PDF 制作成可搜索审阅副本

目标:识别印刷页面,并生成可以搜索和人工校对的文字。

  1. 选择页码范围和文档语言,小字号扫描件可提高渲染倍率。
  2. 运行 OCR 后重点检查低置信度页面、姓名、日期和金额。
  3. 校对完成后导出 TXT 或 JSON,再生成可搜索 PDF。

结果:可以同时获得可搜索副本和可编辑文字,并在使用前复核不确定内容。

常见问题

它和 PDF 文字层提取有什么区别?

文字提取只读取已有的可选文字层;OCR 会渲染页面像素并识别,因此可以处理没有文字层的扫描件。

OCR 会上传我的文档吗?

识别在浏览器 Worker 中运行。会按需下载 Tesseract 引擎和公开语言包,但 PDF 页面不会发送到 ToolsKit 服务器。

可以生成可搜索 PDF 吗?

可以。勾选选项后会把 OCR 结果与页面图像合并;由于扫描版式不同,下载前仍应检查布局。

支持哪些语言?

目前支持英文、简体中文,或英文加简体中文混合模型。

为什么表格或多栏内容容易错位?

OCR 识别的是文字区域,不是电子表格结构。可以提高渲染倍率、选择合适布局,并人工核对导出结果。

为什么第一次识别比较慢?

浏览器需要下载并初始化 OCR Worker、核心文件和语言包;之后可能复用缓存。

继续浏览