图片文字识别 OCR

识别图片或扫描 PDF 中的印刷文字,支持中英文;文件留在浏览器内处理。

首次识别会联网下载 OCR 引擎与所选语言包,随后由浏览器缓存;文档本身不会上传。扫描件若带有不完整的隐藏文字层,请选择“强制 OCR”。

适合识别什么

适合截图、书页、票据和扫描 PDF 中的印刷文字。数字版 PDF 会优先读取其内嵌文本,扫描页才调用 OCR,速度和准确率通常更好。

与版面级 OCR 的区别

这是浏览器端轻量 OCR,可输出纯文本并标出识别区域,但不会重建复杂表格、公式或多栏 Markdown。合同、财务和医疗资料请务必对照原件复核。

PDF 超过 20 页?可先用 PDF 拆分;图片方向或清晰度不理想时,可先用 图片改尺寸 处理。