OCR PDF
Trích xuất văn bản từ PDF được quét hoặc chỉ chứa hình ảnh bằng OCR trên thiết bị, sau đó tải xuống dưới dạng tệp văn bản hoặc tài liệu Word.
Cách sử dụng
- 1
Thả hoặc chọn một PDF đã quét.
- 2
Nhấp Chạy OCR — lần chạy đầu tiên sẽ tải xuống một mô hình ngôn ngữ nhỏ.
- 3
Xem lại văn bản đã trích xuất sau khi xử lý xong.
- 4
Tải xuống dưới dạng tệp văn bản thuần túy hoặc tài liệu Word có thể chỉnh sửa.
Tính năng
- OCR trên thiết bị — không cần tải lên máy chủ
- Hoạt động với các trang đã quét và PDF chỉ chứa hình ảnh
- Xuất dưới dạng .txt hoặc .docx
- Xem trước văn bản từng trang trước khi tải xuống
Câu hỏi thường gặp
Tại sao lần chạy đầu tiên mất nhiều thời gian hơn?
Lần sử dụng đầu tiên sẽ tải xuống một mô hình ngôn ngữ OCR nhỏ, sau đó được trình duyệt của bạn lưu vào bộ nhớ đệm để xử lý nhanh hơn trong các lần chạy sau.
Độ chính xác của việc trích xuất văn bản như thế nào?
Độ chính xác phụ thuộc rất nhiều vào chất lượng bản quét — các bản quét rõ nét, độ phân giải cao với phông chữ tiêu chuẩn cho kết quả tốt nhất; bản quét mờ hoặc độ tương phản thấp có thể có nhiều lỗi hơn.
Những ngôn ngữ nào được hỗ trợ?
Công cụ này hiện đang sử dụng mô hình OCR tiếng Anh.
Tệp PDF đã quét của tôi có được tải lên đâu không?
Không — OCR chạy hoàn toàn trên thiết bị của bạn bằng một công cụ trong trình duyệt; không có gì được gửi đến máy chủ.
