图片转文字 OCR
从截图、收据和照片中提取可编辑文字
转换与创建
🔒 100% 本地运行 — 你的数据不会离开当前页面由 Evan 维护•最近更新:2026年9月30日
工具说明
在浏览器中使用独立 Tesseract worker,从印刷体截图、收据、标签和拍照文档提取可编辑文字。选择不超过 25 MB 的 PNG、JPEG、WebP 或 BMP,再选择英文、简体中文或混合语言及页面布局。OCR 引擎和语言包按需下载,识别本身在本地运行。较小图片可能会放大,但不能恢复缺失的细节。识别后可编辑、复制或下载 TXT/JSON。置信度属于原始引擎结果,修改文本后不会重新计算;JSON 保留识别时的文件、语言与布局,并标记是否经过编辑。手写字、模糊、反光和复杂表格需要人工核对;输出是文本,不是电子表格模型。不保存输入草稿。
场景配方
01
从收据或截图提取文字
目标:快速生成可复用草稿,同时不把 OCR 输出当成已经自动核验的记录。
- 使用清晰、裁切紧凑且反光较少的图片,并选择对应语言模型。
- 识别后对照原图检查金额、姓名、日期和换行。
- 先编辑修正结果,再复制或导出 TXT、JSON。
结果:可以减少手工录入,同时保留对关键字段的明确准确性检查。
常见问题
什么样的图片识别效果最好?
高分辨率、光线均匀、背景干净且文字颜色深的图片通常效果最好;可以先裁掉边框和反光。
能识别手写字吗?
工具主要针对印刷体文字,手写识别不作保证,通常需要人工修改。
OCR 结果可以编辑吗?
可以。结果会显示在可编辑文本框里,确认后再复制或下载。
支持中文吗?
支持。可以选择简体中文,或选择英文加简体中文混合模型。
图片会上传服务器吗?
不会。浏览器下载 OCR 引擎和语言包后,识别在本地完成。
为什么表格列没有保留?
OCR 输出的是文字顺序和置信度,不是真正的表格模型。把结果用于结构化数据前应人工核对。
编辑后置信度表示什么?
仍表示原始 OCR 引擎估计,不是编辑后的准确率。JSON 用 original_ocr 标识置信度来源,并标记是否编辑;更换源文件或识别选项会清空旧结果。
继续浏览