Nhận dạng chữ tiếng Việt từ ảnh / PDF scan (OCR)

OCR Tesseract.js tiếng Việt trên máy. Model tải jsDelivr. Ảnh mờ sẽ sai.

Chạy trên máy

Kéo thả ảnh vào đây, dán (Ctrl+V) hoặc

Ảnh JPG/PNG/WebP. Lần đầu tải WASM + traineddata từ jsDelivr.

Hoặc PDF scan (vẽ trang rồi OCR, tối đa 5 trang):

Kéo thả file PDF vào đây, hoặc

PDF scan. PDF có lớp chữ thì dùng PDF → Word cho chính xác hơn.

Tesseract.js trên máy. Model tải từ jsDelivr. Ảnh mờ/chữ viết tay sẽ sai. Không phải ABBYY.

Cách dùng

  1. Nhập URL, dán chữ hoặc chọn file.
  2. Đọc kết quả và giới hạn.

OCR Tesseract.js tiếng Việt trên máy. Lần đầu tải model từ jsDelivr. Ảnh mờ sẽ sai.

Ví dụ

Danh sách gốcTuỳ chọnKết quả
MẫuMặc địnhKết quả hoặc thông báo CORS

Câu hỏi thường gặp

Có giả vờ làm được việc cần server không?

Không. Tool nào CORS/thiếu codec thì nói rõ.