CanDoYa
ZH

图片转文字

全程在浏览器中运行,无需上传,无需注册。

请选择一张印刷文字清晰的图片开始。

分享此工具

图片转文字的原理是什么?

图片转文字通过OCR(光学字符识别)技术,识别照片或扫描件中的印刷字符,并输出为可编辑文本。本工具在浏览器内运行Tesseract WebAssembly,覆盖CanDoYa全站40个本地化所用语言,识别过程无需上传图片,结果可直接复制或下载。

使用方法

  1. 1选择清晰图片. 拖入JPEG、PNG、WebP、BMP或非动画GIF文件(最大15MB,2400万像素),或加载内置示例。
  2. 2选择文字语言. 请选择图片实际印刷的语言。开始识别时会下载对应的Tesseract语言数据。
  3. 3提取并校对. 运行OCR,与原图比对人名、数字等内容,修正错误后,可复制文本或下载为UTF-8 TXT文件。

适用人群

本工具基于Tesseract.js 7,是Tesseract开源OCR引擎的浏览器移植版。 相关代码、WebAssembly核心和所选语言数据会在您开始识别时加载。Tesseract在独立后台进程中完成识别,页面操作不会受影响。

OCR准确率主要取决于图片本身。建议使用正放、印刷清晰、对比度高、像素充足的图片。小尺寸截图可先放大,倾斜页面、装饰字体、分栏、手写、反光、模糊拍摄等情况更易出错,需人工校对。

常见问题

图片会上传到服务器吗?

不会。选中的图片文件仅在您的设备上由Tesseract后台进程识别。浏览器会从外部源下载OCR运行环境和语言数据,但这些请求不会包含您的图片。CanDoYa不会接收或存储您的图片和识别结果。

图片转文字需要付费吗?

不需要。无需注册、付费、水印、积分或下载费用。识别过程由您的设备完成。首次加载OCR引擎和语言数据会消耗网络流量,较大的语言模型在流量有限时需注意。

支持哪些图片格式和限制?

支持单张JPEG、PNG、WebP、BMP或非动画GIF,最大15MB、2400万像素。此限制有助于避免手机或笔记本内存不足。仅支持图片文件,整页PDF请使用专用PDF OCR工具。

OCR图片转文字的准确率如何?

清晰的印刷体文字通常能较好识别,但无法保证完全准确。聚焦清晰、大字号、高对比、页面平整、语言选择正确时效果最佳。手写、特殊字体、反光、模糊、表格、分栏或混合阅读方向时,可能出现替换或顺序错误。

能识别手写内容吗?

仅对非常工整的印刷体手写有一定效果。本工具主要针对印刷文字,连笔或不规则手写准确率较低。手写识别结果仅供参考,重要内容请务必与原图核对。

应该如何选择识别语言?

请选择图片中文字实际使用的语言,而非浏览器语言。列表覆盖CanDoYa全部40个本地化所用语言,包括简体和繁体中文。若图片含多种语言,请选用主要语言;每次仅加载一个识别模型。

为什么首次识别速度较慢?

浏览器首次需加载Tesseract.js代码、兼容的WebAssembly核心和所选语言的训练数据。后续如有缓存会更快,但无痕模式、清理存储、更换语言或缓存被清除时会重新下载。

提取的文本可以直接使用吗?

建议先核查,尤其是人名、金额、日期、标点和易混字符(如O与0、l与1)。显示的置信度为Tesseract整体估算,不代表每个字都准确,也不保留原文排版。