PDF Boleh Cari

Tambah lapisan teks boleh pilih ke PDF yang diimbas.

🔍

Seret dan lepas, atau tampal skrinset

Imej, PDF, Word (DOCX) atau teks - jatuhkan, layari, tampal, atau guna URL

🔒 Fail anda diproses secara peribadi dan dipadam secara automatik.

Buat PDF boleh dicari dengan menambah lapisan teks OCR tak kelihatan di atas halaman yang diimbas. Dokumen yang diimbas sebenarnya hanyalah satu timbunan imej, jadi anda tidak boleh cari, pilih, atau salin satu perkataan dalamnya. OCR.chat membaca teks dan meletakkannya tepat di atas imbasan asal, menukar imej rata ke PDF yang anda boleh cari dan pilih dalam sebarang pembaca.

Ini adalah alat untuk arkib dan pengurusan dokumen, di mana mampu mencari kontrak oleh klausa atau frasa di sepanjang beribu-ribu halaman adalah titik utama. Ia penting untuk penemuan undang-undang, pemeliharaan rekod, dan digitisasi peti fail, dan ia menjaga halaman anda kelihatan seperti yang diimbas kerana lapisan teks tidak kelihatan dan imej asal tidak disentuh.

OCR.chat adalah percuma untuk dicuba tanpa mendaftar masuk. PDF Boleh Cari berjalan pada aras pantas untuk dokumen cetak dalam lebih 100 bahasa, jadi imbasan berbilang-halaman diproses dengan cepat dan dimuat turun sebagai PDF piawai yang berfungsi dalam Acrobat, Pralihat, pelayar anda, dan pelihat lain, dengan carian teks penuh dan salin-tepek tertanam.

Bagaimana untuk pdf boleh cari

1
Muat naik PDF yang diimbas
Dropkan PDF yang diimbas atau imej halaman yang anda ingin buat boleh dicari.
2
Jalankan OCR
OCR.chat membaca setiap halaman dan meletakkan perkataan yang dikenal pasti tepat di mana mereka muncul pada imbasan.
3
Dapatkan lapisan teks tak kelihatanlayers-action
Teks yang dikenal pasti ditambah sebagai lapisan tak kelihatan di atas imej asal, jadi halaman kelihatan sama tetapi kini boleh dicari.
4
Muat turun PDF boleh gelintar
Simpan PDF piawai yang anda boleh cari, pilih, dan salin dari dalam Acrobat, Pralihat, pelayar anda, atau pembaca mana-mana.

Penggunaan biasa

  • Arkib kontrak, rekod, dan korespondensi yang diimbas supaya anda boleh cari sebarang dokumen mengikut kandungannya.
  • Siapkan bukti yang diimbas dan fail kes untuk penemuan undang-undang dan penilaian teks penuh.
  • Digitkan kabinet fail dokumen kertas ke dalam pustaka PDF yang boleh dicari dan selamat pada masa hadapan.
  • Buat buku, manual, dan bahan rujukan yang diimbas boleh dicari untuk penyelidikan dan rujukan.
  • Tambah teks boleh dicari ke borang dan aplikasi yang diimbas supaya kakitangan boleh mencari masukan dengan cepat.
  • Bina pangkalan pengetahuan yang boleh dicari dari bil, kenyataan dan resit yang diimbas untuk audit.

Pertanyaan yang kerap ditanya

OCR.chat membaca teks pada setiap halaman diimbas dan menambahnya sebagai lapisan tak kelihatan yang disusun di atas imej asal. Halaman kelihatan sama, tetapi teks tersembunyi membolehkan sebarang pembaca PDF mencari, memilih, dan menyalin perkataan darinya.

Tidak. Imej asli yang diimbas disimpan tanpa disentuh dan teks OCR duduk tidak kelihatan di atas, jadi dokumen kelihatan sama dengan apa yang anda muat naik dan boleh dicari sepenuhnya.

Sebarang pembaca piawai. Output adalah PDF biasa, jadi carian, pemilihan, dan salin-tepek berfungsi dalam Adobe Acrobat, Apple Preview, pelayar web anda, dan pelihat biasa lain.

Ya. Setiap halaman dalam PDF diproses dan lapisan teks ditambah sepanjang, jadi carian berfungsi di seluruh dokumen, bukan hanya halaman pertama.

Tahap pantas sesuai untuk imbasan cetak dan menghasilkan lapisan teks yang boleh dipercayai untuk carian. Kerana teks tidak kelihatan, salah bacaan kadang-kadang tidak mengubah bagaimana halaman kelihatan, dan anda boleh semak teks yang dikenali sisi demi sisi sebelum memuat turun.

Lapisan teks boleh dicari menyokong lebih daripada 100 bahasa, termasuk skrip CJK, Arab, Cyrillic, dan India. Anda boleh muat naik PDF yang diimbas serta imej PNG, JPG, dan TIFF, dan teks asing ditranskripsikan seperti ditulis, tidak pernah diterjemahkan.

Hanya sedikit. Lapisan teks tak kelihatan ringan berbanding imej halaman, jadi PDF boleh carian biasanya dekat dalam saiz dengan imbasan asal berbanding melengkung. Data imej kelihatan disimpan seperti sedia ada.

Ya, walaupun tangkapan rata, terang, lurus, bacaan terbaik. Foto telefon yang jelas dari halaman cetak berfungsi dengan baik; bayang berat, cahaya, atau sudut tajam boleh menurunkan ketepatan, jadi ratakan halaman dan elakkan lengkung di mana anda boleh.

Pengimbasan cetak bersih memberikan lapisan teks yang paling boleh dipercayai. Halaman yang pudar, melengkung, atau bising masih mendapat teks boleh dicari, tetapi dengan lebih kemungkinan salah bacaan. Kerana teks tidak kelihatan, ralat tersesat tidak pernah mengubah bagaimana halaman kelihatan, dan anda boleh semak teks yang dikenali sebelum memuat turun.

Fail tunggal berjalan dengan pantas, dan proses kerja fail panjang atau berbilang fail di latar belakang. Penggunaan percuma termasuklah bayaran halaman bulanan; rancangan berbayar dari $5/mo menambah lebih banyak halaman (kredit dikira sebagai halaman) dan pemprosesan batch supaya anda boleh membuat seluruh arkib boleh dicari sekali.

Ya. API REST tersedia pada rancangan berbayar, jadi anda boleh menghantar PDF yang diimbas dan menerima PDF yang boleh dicari dari aliran kerja dokumen anda sendiri tanpa memuat naik setiap satu secara manual.

Anda boleh cuba secara percuma tanpa mendaftar, dan akaun percuma termasuklah jumlah halaman bulanan, dengan rancangan berbayar dari $5/mo untuk lebih banyak halaman, pemprosesan berbilang, dan akses API. Fail hanya diproses untuk OCR, dipadam secara automatik, dan tidak pernah dijual atau dikongsi.

Guna ini melalui API

Jalankan alat ini secara program dengan POST tunggal. Sahkan dengan token API dari halaman akaun anda.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=searchable-pdf"

Fail 5 halaman atau kurang kembalikan hasil dalam baris; jika tidak, sokong kerja, kemudian muat turun sebagai pdf:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=pdf" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.pdf
Baca dokumen API →
Nilai halaman ini
5.0/5 (0)

Apa yang boleh kami perbaiki?