PDF có thể tìm kiếm

Thêm một lớp văn bản có thể chọn vào PDF đã quét.

🔍

Kéo và thả, hoặc dán một bức ảnh màn hình

Hình ảnh, PDF, Word (DOCX) hoặc văn bản - thả, lướt, dán, hoặc sử dụng URL

🔒 Tập tin của anh được xử lý riêng tư và tự động xóa.

Làm cho PDF có thể tìm kiếm bằng cách thêm một lớp văn bản OCR vô hình trên các trang đã quét. Một tài liệu quét thực ra chỉ là một đống hình ảnh, vì vậy bạn không thể tìm, chọn, hay sao chép một từ nào trong đó. OCR.chat đọc văn bản và đặt nó chính xác trên ảnh quét gốc, biến một hình ảnh phẳng thành một PDF có thể tìm kiếm và chọn trong bất kỳ trình đọc nào.

Đây là công cụ quản lý tài liệu và lưu trữ, nơi có thể tìm thấy một hợp đồng theo một điều khoản hay một cụm từ trên hàng ngàn trang là tất cả. Nó là cần thiết cho việc khám phá pháp lý, lưu trữ ghi chép, và số hóa tủ hồ sơ, và nó giữ trang của bạn trông giống như đã quét bởi vì lớp văn bản là vô hình và hình ảnh gốc không bị ảnh hưởng.

OCR.chat có thể được thử miễn phí mà không cần đăng ký. PDF tìm kiếm chạy trên tầng nhanh cho tài liệu in trên hơn 100 ngôn ngữ, vì vậy một bản scan nhiều trang được xử lý nhanh chóng và tải xuống như một PDF tiêu chuẩn hoạt động trong Acrobat, Preview, trình duyệt của bạn, và bất kỳ trình xem nào khác, với tìm kiếm toàn văn và sao chép- dán được tích hợp.

Làm thế nào pdf có thể tìm kiếm

1
Tải lên PDF đã quét
Đưa vào một PDF đã quét hoặc một hình ảnh của trang bạn muốn tìm kiếm.
2
Chạy OCR
OCR.chat đọc từng trang và đặt các từ được nhận dạng chính xác ở nơi chúng xuất hiện trên bản scan.
3
Lớp văn bản ẩn
Văn bản được nhận diện được thêm vào như một lớp vô hình trên hình ảnh gốc, vì vậy trang trông giống nhau nhưng giờ có thể tìm kiếm.
4
Tải xuống PDF có thể tìm kiếm
Lưu một PDF tiêu chuẩn mà bạn có thể tìm kiếm, chọn và sao chép trong Acrobat, Preview, trình duyệt của bạn, hoặc bất kỳ trình đọc nào.

Dùng chung

  • Lưu các hợp đồng, hồ sơ và thư từ đã quét để bạn có thể tìm bất kỳ tài liệu nào theo nội dung của nó.
  • Chuẩn bị các chứng cứ và hồ sơ vụ án để khám phá pháp lý và xem xét toàn văn.
  • Số hóa một tủ hồ sơ tài liệu giấy thành một thư viện PDF có thể tìm kiếm, tương lai.
  • Làm cho sách, hướng dẫn và tài liệu tham khảo được quét có thể tìm kiếm cho nghiên cứu và trích dẫn.
  • Thêm văn bản có thể tìm kiếm vào các mẫu và ứng dụng quét để nhân viên có thể tìm kiếm các mục nhanh chóng.
  • Tạo một cơ sở kiến thức có thể tìm kiếm từ hóa đơn, báo cáo và chứng từ được quét để kiểm toán.

Câu hỏi thường gặp

OCR.chat đọc văn bản trên mỗi trang quét và thêm nó như một lớp vô hình được sắp xếp trên hình ảnh gốc. Trang trông giống như nhau, nhưng văn bản ẩn cho phép bất kỳ trình đọc PDF nào tìm, chọn và sao chép từ nó.

Không. Bức ảnh scan gốc được giữ nguyên và văn bản OCR được đặt ở trên, vì vậy tài liệu trông giống như bạn đã tải lên và có thể tìm kiếm hoàn toàn.

Bất kỳ trình đọc tiêu chuẩn nào. Kết quả là một PDF bình thường, vì vậy tìm kiếm, chọn, và sao chép- dán hoạt động trong Adobe Acrobat, Apple Preview, trình duyệt web của bạn, và các trình xem thông thường khác.

Có. Mỗi trang trong PDF đều được xử lý và lớp văn bản được thêm vào, vì vậy tìm kiếm hoạt động trên toàn bộ tài liệu, không chỉ trang đầu tiên.

Bước nhanh thích hợp cho việc quét in và tạo ra một lớp văn bản đáng tin cậy để tìm kiếm. Bởi vì văn bản là vô hình, một lỗi đọc thỉnh thoảng không thay đổi cách trang trông, và bạn có thể xem lại văn bản được nhận dạng bên cạnh bên trước khi tải xuống.

Lớp văn bản có thể tìm kiếm hỗ trợ hơn 100 ngôn ngữ, bao gồm cả chữ CJK, Ả Rập, Cyril và Ấn Độ. Bạn có thể tải lên các PDF đã quét cũng như ảnh PNG, JPG và TIFF, và văn bản nước ngoài được chuyển tự như đã viết, không bao giờ dịch.

Chỉ một chút thôi. Lớp văn bản vô hình nhẹ hơn so với ảnh trang, vì vậy PDF có thể tìm kiếm thường có kích thước gần với ảnh scan gốc hơn là bị bong bóng. Dữ liệu ảnh hiển thị được giữ nguyên.

Có, mặc dù một bức ảnh phẳng, ánh sáng đều, chụp thẳng đứng sẽ đọc tốt nhất. Một bức ảnh điện thoại rõ ràng của trang in sẽ hoạt động tốt; bóng tối dày, ánh sáng chói lọi, hoặc góc độ dốc có thể làm giảm độ chính xác, vì vậy phẳng trang và tránh lệch khi có thể.

Những trang bị in sạch sẽ cho bạn lớp văn bản đáng tin cậy nhất. Những trang bị bị phai, lệch hay ồn vẫn có thể tìm kiếm văn bản, nhưng có nhiều khả năng bị đọc sai. Vì văn bản là vô hình, lỗi lạc không bao giờ thay đổi cách trang trông, và bạn có thể xem lại văn bản được nhận ra trước khi tải xuống.

Tập tin đơn chạy nhanh, và các công việc nhiều tập tin hay dài hơn được xử lý ở nền. Dùng miễn phí bao gồm một số trang được phép hàng tháng; kế hoạch trả tiền từ $5/ tháng thêm nhiều trang (credits count as pages) và xử lý hàng loạt để bạn có thể tìm kiếm toàn bộ kho lưu trữ cùng một lúc.

Có. Một API REST có sẵn trên các kế hoạch trả phí, vì vậy bạn có thể gửi các PDF quét và nhận các PDF tìm kiếm từ luồng tài liệu của riêng bạn mà không cần tải lên mỗi một cái bằng tay.

Bạn có thể thử miễn phí mà không cần đăng ký, và một tài khoản miễn phí bao gồm một trang hàng tháng, với các kế hoạch trả tiền từ $5/mo cho nhiều trang hơn, xử lý hàng loạt, và truy cập API. Tập tin chỉ được xử lý cho OCR, tự động xóa, và không bao giờ bán hoặc chia sẻ.

Dùng nó qua API

Chạy công cụ này theo lập trình với một POST duy nhất. Xác thực với token API từ trang tài khoản của bạn.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=searchable-pdf"

Tập tin có 5 trang hoặc ít hơn trả về kết quả trong dòng; nếu không thì hỏi công việc, sau đó tải về nó như pdf:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=pdf" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.pdf
Đọc tài liệu API →
Đánh giá trang này
5.0/5 (0)

Chúng tôi có thể cải thiện gì? phản hồi của bạn giúp chúng tôi khắc phục vấn đề.