0

English OCR — Trích xuất văn bản tiếng Anh từ hình ảnh

Trích xuất văn bản từ hình ảnh bằng OCR trực tiếp trong trình duyệt của bạn: JPG, PNG, WebP và BMP bằng 12 ngôn ngữ nhận dạng.

🔍

Kéo và thả hình ảnh vào đây

hoặc Bấm để duyệt tập tin

Đang xử lý... 0%
Đọc tập tin hình ảnh
Khởi động động cơ OCR
Đang tải mô hình ngôn ngữ
Nhận dạng văn bản

kết quả

Preview Output

Trang này mở công cụ chuyển hình ảnh thành văn bản bằng tiếng Anh đã được chọn làm ngôn ngữ nhận dạng - thả ảnh chụp màn hình, bản quét hoặc ảnh và nhấn nút. Tiếng Anh là ngôn ngữ mà Tesseract OCR xử lý tốt nhất: công cụ được đào tạo trên kho văn bản in tiếng Anh khổng lồ, do đó, các bản quét sạch thường xuyên đạt độ tin cậy trên 95%.

OCR tiếng Anh hoạt động tốt ngay cả trên các nguồn phức tạp — ảnh chụp màn hình thiết bị đầu cuối, trang sách được chụp ở một góc, biên lai và nhãn sản phẩm. Để có kết quả tốt nhất, hãy cung cấp cho công cụ văn bản sắc nét cao ít nhất 20–30 pixel; nếu ảnh bị mờ hoặc văn bản quá nhỏ, hãy nâng cấp hình ảnh trước khi nhận dạng và độ chính xác thường tăng vọt đáng kể.

Mọi thứ đều chạy cục bộ trong trình duyệt của bạn: hình ảnh không bao giờ được tải lên, chỉ có mô hình ngôn ngữ tiếng Anh nhỏ gọn (vài megabyte) được tìm nạp một lần và được lưu vào bộ nhớ đệm. Khi quá trình nhận dạng hoàn tất, hãy sao chép văn bản bằng một cú nhấp chuột hoặc tải xuống dưới dạng tệp .txt.