OCR PDF
Biến bản scan thành PDF tìm kiếm, bôi đen và sao chép chữ được, hỗ trợ tiếng Việt có dấu.
Kéo thả tệp PDF vào đây
PDF · tối đa 100 MB mỗi tệp
Tệp tự xóa sau 2 giờ. Bạn có thể xóa ngay sau khi tải về.
Cách dùng OCR PDF trong 3 bước
-
Tải lên bản PDF scan
Kéo thả tệp scan vào khung tải lên hoặc bấm để chọn từ máy, điện thoại. Có thể lấy tệp từ Google Drive hay từ liên kết tải trực tiếp.
-
Chọn ngôn ngữ tài liệu
Mặc định là Việt + Anh, hợp với tài liệu có cả hai thứ tiếng. Chọn Tiếng Việt hoặc Tiếng Anh nếu tài liệu chỉ dùng một ngôn ngữ.
-
Nhận dạng chữ và tải về
Bấm “Nhận dạng chữ” để tạo PDF có lớp chữ, rồi tải về hoặc lưu lên Google Drive. Muốn sửa nội dung, bấm “Làm tiếp” và chọn PDF sang Word.
Tính năng
OCR PDF nhận dạng chữ trong tài liệu scan hoặc ảnh chụp đã lưu thành PDF, rồi tạo tệp PDF mà bạn có thể tìm kiếm, bôi đen và sao chép nội dung. Công cụ hữu ích với công văn, hợp đồng giấy, sách cũ hay hóa đơn cần trích thông tin. Bạn chọn ngôn ngữ của tài liệu: Tiếng Việt, Tiếng Anh hoặc Việt + Anh.
- Nhận dạng tiếng Việt có dấu, tiếng Anh hoặc tài liệu song ngữ Việt + Anh.
- Kết quả là PDF tìm kiếm được: bôi đen, sao chép và tra cứu chữ bằng Ctrl+F.
- Nối tiếp sang PDF sang Word để chỉnh sửa nội dung vừa nhận dạng.
- Tệp kết quả mang tên gốc thêm -ocr, ví dụ cong-van.pdf thành cong-van-ocr.pdf.
- Nhận một tệp PDF tới 100 MB mỗi lượt, không cần tạo tài khoản.
Câu hỏi thường gặp
OCR có nhận dạng được tiếng Việt có dấu không?
Có. Chọn Tiếng Việt hoặc Việt + Anh để nhận dạng chữ có dấu. Bản scan càng rõ, thẳng và đủ sáng thì kết quả càng chính xác.
Sau khi OCR có sửa được chữ không?
Tệp kết quả là PDF cho phép tìm kiếm và sao chép chữ, chưa phải văn bản chỉnh sửa được. Hãy chuyển tiếp sang PDF sang Word để nhận tệp .docx mở bằng Word, Google Docs hoặc LibreOffice.
Chụp tài liệu bằng điện thoại thì làm OCR thế nào?
Gộp các ảnh chụp thành PDF bằng công cụ Ảnh sang PDF, sau đó bấm “Làm tiếp” và chọn OCR PDF để nhận dạng chữ.
Chữ viết tay có nhận dạng được không?
OCR chính xác nhất với chữ in rõ nét. Chữ viết tay, con dấu hay bản scan mờ thường bị nhận dạng sai hoặc bỏ sót.