本工具基于Tesseract.js 7,是Tesseract开源OCR引擎的浏览器移植版。 相关代码、WebAssembly核心和所选语言数据会在您开始识别时加载。Tesseract在独立后台进程中完成识别,页面操作不会受影响。
OCR准确率主要取决于图片本身。建议使用正放、印刷清晰、对比度高、像素充足的图片。小尺寸截图可先放大,倾斜页面、装饰字体、分栏、手写、反光、模糊拍摄等情况更易出错,需人工校对。
全程在浏览器中运行,无需上传,无需注册。
图片转文字通过OCR(光学字符识别)技术,识别照片或扫描件中的印刷字符,并输出为可编辑文本。本工具在浏览器内运行Tesseract WebAssembly,覆盖CanDoYa全站40个本地化所用语言,识别过程无需上传图片,结果可直接复制或下载。
本工具基于Tesseract.js 7,是Tesseract开源OCR引擎的浏览器移植版。 相关代码、WebAssembly核心和所选语言数据会在您开始识别时加载。Tesseract在独立后台进程中完成识别,页面操作不会受影响。
OCR准确率主要取决于图片本身。建议使用正放、印刷清晰、对比度高、像素充足的图片。小尺寸截图可先放大,倾斜页面、装饰字体、分栏、手写、反光、模糊拍摄等情况更易出错,需人工校对。
不会。选中的图片文件仅在您的设备上由Tesseract后台进程识别。浏览器会从外部源下载OCR运行环境和语言数据,但这些请求不会包含您的图片。CanDoYa不会接收或存储您的图片和识别结果。
不需要。无需注册、付费、水印、积分或下载费用。识别过程由您的设备完成。首次加载OCR引擎和语言数据会消耗网络流量,较大的语言模型在流量有限时需注意。
支持单张JPEG、PNG、WebP、BMP或非动画GIF,最大15MB、2400万像素。此限制有助于避免手机或笔记本内存不足。仅支持图片文件,整页PDF请使用专用PDF OCR工具。
清晰的印刷体文字通常能较好识别,但无法保证完全准确。聚焦清晰、大字号、高对比、页面平整、语言选择正确时效果最佳。手写、特殊字体、反光、模糊、表格、分栏或混合阅读方向时,可能出现替换或顺序错误。
仅对非常工整的印刷体手写有一定效果。本工具主要针对印刷文字,连笔或不规则手写准确率较低。手写识别结果仅供参考,重要内容请务必与原图核对。
请选择图片中文字实际使用的语言,而非浏览器语言。列表覆盖CanDoYa全部40个本地化所用语言,包括简体和繁体中文。若图片含多种语言,请选用主要语言;每次仅加载一个识别模型。
浏览器首次需加载Tesseract.js代码、兼容的WebAssembly核心和所选语言的训练数据。后续如有缓存会更快,但无痕模式、清理存储、更换语言或缓存被清除时会重新下载。
建议先核查,尤其是人名、金额、日期、标点和易混字符(如O与0、l与1)。显示的置信度为Tesseract整体估算,不代表每个字都准确,也不保留原文排版。