0

英文 OCR — 从图像中提取英文文本

直接在浏览器中使用 OCR 从图像中提取文本:12 种识别语言的 JPG、PNG、WebP 和 BMP。

🔍

将图像拖放到此处

或点击浏览文件

处理中... 0%
读取图像文件
启动 OCR 引擎
加载语言模型
识别文本

结果

Preview Output

此页面打开图像到文本工具,并已选择英语作为识别语言 - 放置屏幕截图、扫描件或照片,然后按按钮。英语是 Tesseract OCR 处理效果最好的语言:该引擎经过大量英语印刷体训练,因此干净的扫描通常可以达到 95% 以上的置信度。

英语 OCR 即使在棘手的来源上也能很好地工作——终端屏幕截图、以一定角度拍摄的书页、收据和产品标签。为了获得最佳效果,请为引擎提供至少 20-30 像素高的清晰文本;如果照片模糊或文字很小,在识别之前放大图像,准确度通常会显着提高。

一切都在您的浏览器本地运行:图像永远不会上传,仅获取一次并缓存紧凑的英语语言模型(几兆字节)。识别完成后,一键复制文本或将其下载为 .txt 文件。