Công cụ PDF
Sao chữ có thể chọn trong file PDF
Sao chữ từ PDF có lớp chữ và lưu .txt. Đây không phải OCR, không đọc ảnh trang scan.
Mở PDF có chữ trên máy này. File scan chỉ toàn ảnh cần công cụ OCR riêng.
- Xử lý trong trình duyệt
- Không tải lên
- Tức thì
- Miễn phí
Đang đọc trang…
Cách hoạt động
- 01 Chọn một PDF trên thiết bị của bạn.
- 02 Giữ ngắt trang nếu bạn muốn mỗi trang được gắn nhãn hoặc bỏ qua các dòng trống thừa.
- 03 Chọn Trích xuất văn bản. Công việc chạy trong trình duyệt của bạn.
- 04 Sao chép kết quả hoặc tải xuống tệp.txt.
Vì sao chọn NEXNARA
-
Riêng tư
Dữ liệu ở lại trong trình duyệt.
-
Tức thì
Kết quả hiện ngay.
-
Không tải lên
Không gửi gì tới máy chủ NEXNARA.
-
Dùng mọi nơi
Không cần cài đặt.
Tìm hiểu thêm
PDF thành văn bản là gì?
PDF to Text là trình trích xuất văn bản PDF dành cho các tệp đã chứa một lớp văn bản. Nó sao chép văn bản đó theo thứ tự trang. Nó không phải là PDF OCR và nó không đọc văn bản từ ảnh của các trang.
Giới hạn
Các cột hoặc bảng phức tạp có thể không khớp với thứ tự đọc trực quan vì các đối tượng văn bản PDF được lưu trữ theo trình tự riêng của chúng. Quét chỉ hình ảnh có ít hoặc không có văn bản để trích xuất. Các PDF được bảo vệ bằng mật khẩu không được mở. Các tệp trên 80 MB hoặc 400 trang bị từ chối để bảo vệ bộ nhớ trình duyệt.
Sự riêng tư
PDF vẫn còn trong trình duyệt của bạn. Nó không được tải lên máy chủ NEXNARA.
Câu hỏi thường gặp
Tính năng này có hoạt động với PDF được quét không?
Thường thì không. Nếu tệp là ảnh của một trang thì không có lớp văn bản nào để sao chép. Sử dụng công cụ PDF OCR chuyên dụng cho việc đó.
Tại sao thứ tự văn bản lại khác nhau?
PDFs lưu trữ văn bản dưới dạng đối tượng, không phải lúc nào cũng theo thứ tự bạn đọc chúng. Bố cục và bảng nhiều cột có thể xuất hiện theo một trình tự khác.
PDF của tôi đã được tải lên chưa?
Không. Quá trình trích xuất sẽ chạy trong trình duyệt của bạn. Tệp không được gửi tới NEXNARA.
Tôi có thể tải xuống văn bản không?
Đúng. Sử dụng Copy hoặc Download.txt sau khi giải nén.