TXT

图片转文字 OCR

从截图、收据和照片中提取可编辑文字

转换与创建
🔒 100% 本地运行 — 你的数据不会离开当前页面
由 Evan 维护•最近更新:2026年9月30日
图片文字识别

OCR 引擎和语言包在点击后按需下载,识别本身在浏览器本地运行。首次加载可能需要几秒。

识别结果

识别出的可编辑文字会显示在这里。

工具说明

在浏览器中使用独立 Tesseract worker,从印刷体截图、收据、标签和拍照文档提取可编辑文字。选择不超过 25 MB 的 PNG、JPEG、WebP 或 BMP,再选择英文、简体中文或混合语言及页面布局。OCR 引擎和语言包按需下载,识别本身在本地运行。较小图片可能会放大,但不能恢复缺失的细节。识别后可编辑、复制或下载 TXT/JSON。置信度属于原始引擎结果,修改文本后不会重新计算;JSON 保留识别时的文件、语言与布局,并标记是否经过编辑。手写字、模糊、反光和复杂表格需要人工核对;输出是文本,不是电子表格模型。不保存输入草稿。

场景配方

01

从收据或截图提取文字

目标:快速生成可复用草稿,同时不把 OCR 输出当成已经自动核验的记录。

  1. 使用清晰、裁切紧凑且反光较少的图片,并选择对应语言模型。
  2. 识别后对照原图检查金额、姓名、日期和换行。
  3. 先编辑修正结果,再复制或导出 TXT、JSON。

结果:可以减少手工录入,同时保留对关键字段的明确准确性检查。

常见问题

什么样的图片识别效果最好?

高分辨率、光线均匀、背景干净且文字颜色深的图片通常效果最好;可以先裁掉边框和反光。

能识别手写字吗?

工具主要针对印刷体文字,手写识别不作保证,通常需要人工修改。

OCR 结果可以编辑吗?

可以。结果会显示在可编辑文本框里,确认后再复制或下载。

支持中文吗?

支持。可以选择简体中文,或选择英文加简体中文混合模型。

图片会上传服务器吗?

不会。浏览器下载 OCR 引擎和语言包后,识别在本地完成。

为什么表格列没有保留?

OCR 输出的是文字顺序和置信度,不是真正的表格模型。把结果用于结构化数据前应人工核对。

编辑后置信度表示什么?

仍表示原始 OCR 引擎估计,不是编辑后的准确率。JSON 用 original_ocr 标识置信度来源,并标记是否编辑;更换源文件或识别选项会清空旧结果。

继续浏览