
OCR PDF là quá trình nhận diện chữ trên bản quét thành lớp văn bản có thể tìm kiếm, được xử lý trên máy chủ. Khi tài liệu chỉ là ảnh của trang giấy, bạn có thể thêm một hoặc nhiều PDF, chọn ngôn ngữ xuất hiện rồi tải về PDF có thể tìm kiếm. Kết quả vẫn là PDF để tìm, chọn và sao chép chữ; đây không phải chuyển đổi trực tiếp sang Word.
Bạn có thể làm gì với OCR PDF
Tìm kiếm và sao chép chữ trong bản scan
Nhận diện văn bản giúp PDF đã quét có thể tìm kiếm như một tài liệu thông thường. Sau khi xử lý, bạn có thể tìm từ khóa, chọn đoạn chữ đã nhận diện và sao chép nội dung trực tiếp từ PDF đầu ra. Cách này phù hợp với hồ sơ lưu trữ, tài liệu giấy được quét hoặc ghi chú cần tra cứu.
Chọn đúng ngôn ngữ của tài liệu
Chọn tiếng Việt hoặc những ngôn ngữ thực sự xuất hiện trong tài liệu để việc nhận diện phù hợp hơn. Dịch vụ hỗ trợ 30 ngôn ngữ và có thể kết hợp tối đa 5 ngôn ngữ trong một lần xử lý. Chỉ nên chọn ngôn ngữ cần thiết, vì chọn thêm ngôn ngữ sẽ làm quá trình nhận diện chậm hơn.
Chỉ quét các trang chưa có văn bản
Chế độ khuyên dùng chỉ nhận diện những trang chưa có chữ có thể chọn. Các trang đã chứa văn bản sẽ được giữ nguyên, giúp bạn bổ sung lớp chữ cho phần scan mà không cần xử lý lại toàn bộ tài liệu. Đây là lựa chọn hữu ích với PDF gồm cả trang điện tử lẫn trang quét.
Nhận dạng lại lớp chữ bị sai
Nếu PDF đã có văn bản có thể chọn nhưng nội dung được nhận diện sai, hãy chọn nhận dạng lại văn bản hiện có. Lớp chữ cũ sẽ bị xóa và trang được đọc lại. Bạn cũng có thể coi mỗi trang là hình ảnh để nhận diện từ đầu; khi đó, văn bản có thể chọn và liên kết cũ sẽ bị mất.
Làm thẳng và xoay đúng chiều trang quét
Bật tùy chọn sửa lỗi trang để làm thẳng các trang bị quét nghiêng và tự động xoay trang ngược hoặc lệch chiều về hướng dễ đọc. Làm thẳng trang không khả dụng khi bạn chọn nhận dạng lại văn bản hiện có. Những điều chỉnh này giúp tài liệu rõ ràng hơn trước khi tạo lớp chữ.
Xử lý nhiều PDF thành từng tệp riêng
Bạn có thể thêm nhiều PDF trong cùng một lần. Mỗi tệp được nhận diện riêng, không bị gộp với các tệp khác. Khi hoàn tất, hãy tải xuống từng PDF có thể tìm kiếm để giữ nguyên cấu trúc tài liệu và dễ quản lý kết quả theo từng hồ sơ.
Cách OCR PDF trực tuyến

Thêm các PDF đã quét cần nhận diện
Nhấn "Chọn các file PDF" và chọn một hoặc nhiều tệp PDF từ thiết bị của bạn. Mỗi tệp sẽ được xử lý riêng và kết quả đầu ra tương ứng vẫn là một tệp PDF.
Chọn mọi ngôn ngữ có trong tài liệu
Chọn ít nhất một ngôn ngữ, bao gồm tiếng Việt nếu tài liệu có nội dung tiếng Việt. Với tài liệu song ngữ hoặc nhiều ngôn ngữ, hãy chọn đầy đủ các ngôn ngữ xuất hiện, tối đa 5 ngôn ngữ.
Chọn các trang cần quét văn bản
Giữ tùy chọn quét các trang chưa có văn bản nếu tài liệu đã có một số trang chọn được chữ. Chỉ chọn nhận dạng lại văn bản hiện có khi lớp chữ cũ sai, hoặc coi từng trang là hình ảnh khi cần đọc lại toàn bộ từ đầu.
Sửa trang nghiêng rồi bắt đầu OCR
Chọn làm thẳng trang bị nghiêng và tự động sửa hướng trang nếu cần. Sau đó nhấn "Nhận dạng văn bản" để bắt đầu. Nhận diện tệp nhiều trang có thể mất vài phút, nhất là khi xử lý nhiều tệp hoặc chọn nhiều ngôn ngữ.
Tải xuống từng PDF có thể tìm kiếm
Khi hoàn tất, tải xuống PDF có thể tìm kiếm của từng tệp. Bạn có thể tìm và sao chép văn bản trong tài liệu mới. Lưu ý: OCR thay đổi nội dung PDF, nên chữ ký số hiện có sẽ không còn hiệu lực.
Xử lý trên máy chủ với thời gian lưu tệp ngắn
Với dịch vụ chạy trên máy chủ này, PDF Toucan gửi tệp PDF qua HTTPS đến máy chủ tại Liên minh châu Âu. Tệp được xử lý trong bộ nhớ, không được ghi vào đĩa và không được lưu trữ. Tệp sẽ bị xóa ngay sau khi bạn tải kết quả xuống, hoặc muộn nhất sau 10 phút nếu không có lượt tải xuống. Dịch vụ miễn phí, không yêu cầu tạo tài khoản và không thêm hình mờ; quảng cáo giúp duy trì trang web. Các công cụ chạy trên trình duyệt không có giới hạn lượt dùng hằng ngày. Vì OCR thay đổi PDF, chữ ký số có sẵn sẽ không còn hiệu lực.
Được xử lý trong bộ nhớ trên máy chủ của chúng tôi tại Liên minh châu Âu. Tệp của bạn không bao giờ được lưu: sẽ bị xóa ngay khi bạn tải kết quả xuống (muộn nhất sau 10 phút).
Câu hỏi thường gặp về OCR PDF
OCR PDF là gì và dùng để làm gì?
Đó là cách nhận diện chữ trong các trang PDF đã quét để tạo lớp văn bản có thể tìm, chọn và sao chép. Bạn dùng tính năng này khi tài liệu trông như ảnh trang giấy và chức năng tìm kiếm trong PDF chưa tìm được nội dung.
Làm sao để OCR PDF miễn phí trực tuyến?
Bạn có thể dùng dịch vụ ocr pdf miễn phí mà không cần tạo tài khoản. Thêm tệp, chọn ngôn ngữ, chọn phạm vi trang rồi bắt đầu nhận diện. PDF đầu ra không có hình mờ và có thể mất vài phút nếu tài liệu nhiều trang hoặc dùng nhiều ngôn ngữ.
PDF scan có thể tìm kiếm mà không cần tạo tài khoản không?
Có. Bạn chỉ cần chọn PDF, đặt ngôn ngữ tài liệu và chạy nhận diện để tạo PDF có thể tìm kiếm. Không cần đăng ký tài khoản. Sau khi hoàn tất, bạn có thể tìm từ, chọn văn bản và sao chép phần chữ đã được nhận diện.
Tôi có thể chọn tiếng Việt khi OCR PDF không?
Có. Bạn có thể chọn tiếng Việt trong danh sách ngôn ngữ nhận diện. Khi cần ocr pdf tiếng Việt cho tài liệu song ngữ, hãy thêm cả ngôn ngữ còn lại nếu có. Chỉ chọn các ngôn ngữ xuất hiện thực tế để tránh làm chậm xử lý.
Văn bản đã chọn được trong PDF có bị thay đổi không?
Không, nếu bạn dùng tùy chọn khuyên dùng là quét các trang chưa có văn bản. Các trang đã có chữ có thể chọn sẽ được giữ nguyên. Nếu chọn nhận dạng lại văn bản hiện có hoặc coi mọi trang là ảnh, lớp chữ cũ có thể bị xóa.
Vì sao chữ ký số không còn hiệu lực sau khi OCR?
Vì OCR làm thay đổi tệp PDF bằng cách thêm hoặc thay lớp văn bản nhận diện. Khi nội dung tệp thay đổi, chữ ký số hiện có không còn khớp với tài liệu. Hãy giữ bản gốc đã ký nếu bạn cần duy trì trạng thái hiệu lực của chữ ký.
Sau khi OCR, có chuyển PDF sang Word được không?
Có. Trước hết, hãy tạo PDF có thể tìm kiếm bằng OCR; sau đó dùng công cụ pdf-to-word nếu cần một tệp Word để tiếp tục chỉnh sửa. OCR chỉ tạo PDF có lớp chữ nhận diện, không chuyển trực tiếp tài liệu sang Word.
Sau khi nhận diện, dùng pdf-to-word nếu bạn cần tiếp tục chỉnh sửa nội dung trong Word. Nếu PDF có dung lượng lớn hơn sau khi thêm lớp văn bản, compress có thể giúp giảm dung lượng trước khi gửi hoặc lưu trữ. Hãy luôn giữ bản gốc, nhất là với tài liệu đã ký số.
Cập nhật lần cuối 20 tháng 9, 2026