FreePDF logoFreePDF

OCR PDF quét: tìm kiếm và sao chép được chữ, miễn phí

Bởi đội ngũ FreePDF ·

Một PDF quét thực chất chỉ là ảnh chụp của trang giấy, lưu với đuôi .pdf. Bạn không tìm kiếm được, không chọn được một câu để sao chép, và trình đọc màn hình cũng chịu. OCR (nhận dạng ký tự quang học) hóa giải chuyện đó bằng cách đọc chữ trong ảnh rồi thêm nó trở lại ở phía sau.

OCR thật ra thay đổi điều gì

Bản quét vẫn nguyên vẹn — cùng bố cục, cùng nét chữ viết tay, cùng cả vết cà phê nếu có. Cái được thêm vào là một lớp chữ thật, chọn được, vô hình, nằm đúng phía sau các con chữ trong ảnh, nên trang trông y hệt nhưng giờ hoạt động như một tài liệu bình thường.

Chạy OCR

  1. Mở công cụ OCR PDF và tải tệp quét của bạn lên.
  2. Chữ trong từng trang được nhận diện và thêm vào thành một lớp tìm kiếm được nằm phía sau.
  3. Tải PDF tìm kiếm được về.

Khi nào bạn thật sự cần đến việc này

  • Tìm một điều khoản trong một hợp đồng hay báo cáo quét dài thay vì đọc hết từng trang.
  • Sao chép một đoạn ra khỏi bản quét thay vì ngồi gõ lại bằng tay.
  • Giúp một tài liệu quét cũ dùng được với trình đọc màn hình.
  • Chuẩn bị một bản quét để chuyển đổi tiếp — trích bảng hay trích chữ chỉ chạy được khi đã có chữ thật để đọc.

Để có kết quả chính xác

Độ chính xác của OCR bám sát chất lượng bản quét:

  • Một bản quét rõ, thẳng, đủ sáng đọc gần như hoàn hảo.
  • Ảnh độ phân giải thấp, nghiêng nhiều, hay chữ viết tay thì khó nhận diện đáng tin cậy hơn — quét lại cho phẳng và đủ sáng nếu lần đầu ra không ổn.
  • Nó được tối ưu cho chữ tiếng Anh; các ngôn ngữ khác có thể ra nhiều lỗi hơn.

Câu hỏi thường gặp

Sau đó trang có trông khác đi không?

Không. Ảnh gốc được giữ nguyên đúng như cũ — OCR chỉ thêm một lớp chữ vô hình phía sau, chứ không vẽ lại hay thay thế trang.

Sau đó tôi chuyển tệp sang Word hoặc Excel được không?

Được, và đó thường chính là mục đích — chạy OCR trước để có chữ thật hoặc dữ liệu bảng bên dưới, rồi chuyển sang Word, Excel hay văn bản thuần như bình thường.

Công cụ miễn phí liên quan