Tesseract.js OCR

图片文字识别 OCR

从截图、扫描件和照片中提取可编辑文字,支持中英文等多种语言,全程在浏览器本地完成。

图片保留在你的设备上11 种语言选项结果可编辑

拖放或粘贴图片到这里

支持 JPG、PNG、WebP、GIF、BMP · 最大 20 MB

也可以按 Ctrl/⌘ + V 粘贴截图。

图片在浏览器本地处理

原图会直接交给当前浏览器内的 Tesseract.js Web Worker,不会上传至 MediaKit。OCR 程序和所选语言模型会在需要时下载,模型随后可由浏览器缓存。

使用方法

三步提取图片文字

建议使用对焦清晰、文字与背景对比明显的图片,并选择图片中文字对应的语言。

  1. 01

    添加图片

    拖放、选择或粘贴一张包含文字的图片。

  2. 02

    设置语言与布局

    选择主要文字语言,并根据文档、截图或海报设置页面布局。

  3. 03

    识别并导出

    运行 OCR,校对可编辑结果,然后复制或下载 TXT。

提高 OCR 识别准确率

1

使用清晰图片

高分辨率、文字边缘清晰且光照均匀的图片更容易准确识别。

2

选择正确语言

正确的语言模型可以帮助 Tesseract 区分外观相近的字母和字符。

3

匹配页面布局

海报和界面截图适合“零散文字”,文档段落适合“单个文本块”。

FAQ

常见问题

图片会上传吗?

不会。文字识别在你的设备上通过 Web Worker 运行,页面只会下载 OCR 程序和语言数据。

支持哪些语言?

页面提供英语、简体中文、繁体中文、日语、韩语、法语、德语、西班牙语、葡萄牙语、意大利语和俄语选项。

为什么第一次识别比较慢?

首次使用需要下载 OCR 引擎和所选语言模型,之后浏览器可以使用缓存。

能保留原图片的排版吗?

OCR 会尽量保留有效换行,但复杂分栏、表格、字体和精确间距通常还需要手动整理。

相关工具

继续处理你的图片