OCR 通过分析图片中的字形把像素转换为可复制文本,支持英文、简体中文、繁体中文和日文识别。工具在浏览器中加载所选语言模型并处理图片,适合从截图、扫描件和照片中提取初稿。
识别准确率受清晰度、字体、方向、语言、排版和背景干扰影响。表格、手写体、竖排文字、艺术字体和低对比照片容易丢失结构或混淆字符,因此 OCR 输出必须与原图校对,不能直接作为金额、合同条款或身份信息的唯一依据。
从扫描件、截图或拍照文档中识别提取文字内容,浏览器本地运行开源 OCR 引擎,图片不会上传。
识别会在本地 Worker 中完成文本检测、方向判断、裁剪识别和结果合并;首次使用需要下载模型资源。
上传图片后点击开始识别
OCR 通过分析图片中的字形把像素转换为可复制文本,支持英文、简体中文、繁体中文和日文识别。工具在浏览器中加载所选语言模型并处理图片,适合从截图、扫描件和照片中提取初稿。
识别准确率受清晰度、字体、方向、语言、排版和背景干扰影响。表格、手写体、竖排文字、艺术字体和低对比照片容易丢失结构或混淆字符,因此 OCR 输出必须与原图校对,不能直接作为金额、合同条款或身份信息的唯一依据。
裁掉无关区域,纠正方向,并尽量提高文字与背景的对比度。
选择与大多数文字匹配的模型,再开始识别并等待进度完成。
对照原图检查数字、标点、专有名词和换行,修正后再用于后续流程。
从无法选择文本的界面、报错截图或图片说明中复制内容。
把印刷文档转换为可搜索初稿,再由人工恢复段落和表格结构。
只有截图没有原文时,识别出文字再校对,比照着屏幕重新敲一遍快得多。