PDF ke Teks

Ubah pemindaian atau PDF digital ke dalam teks biasa.

📄

Seret dan jatuhkan, atau tempel cuplikan layar

Image, PDF, Word (DOCX) atau teks - drop, ramban, paste, atau gunakan URL

🔒 Berkas Anda diproses secara pribadi dan dihapus secara otomatis.

OCR.chat mengekstrak teks dari PDF manapun, entah itu ekspor digital atau stack dari halaman yang dipindai. Upload satu multi halaman PDF dan setiap halaman diproses dan dikombinasikan menjadi satu bersih, hasil yang telah siap disalin. Halaman yang telah memuat suatu lapis teks asli dibaca seketika dan losslessly, sementara halaman yang dipindai dijalankan melalui OCR secara otomatis, sehingga Anda selalu mendapatkan teks yang paling akurat yang dapat ditawarkan berkas.

PDF ini untuk pengubah teks dibuat untuk orang-orang yang bekerja dengan dokumen lama: peneliti pertambangan kertas-kertas tua, paralegal mengubah berkas kasus menjadi teks yang dapat dicari, dan analis menarik angka-angka dari laporan dipindai. Ini membaca lebih dari 100 bahasa, menunjukkan teks yang diekstrak di samping halaman asli untuk review, dan tidak pernah diam-diam menerjemahkan kata-kata asing, sehingga PDF multibahasa keluar persis seperti yang masuk.

Tidak ada pendaftaran yang diperlukan untuk mencobanya, dan mesin cepat menangani standar yang dicetak PDF secara gratis. Ketika sebuah dokumen memiliki tabel, kolom, atau tulisan tangan, mesin premium memberikan akurasi yang lebih tinggi. Unduh hasilnya sebagai teks biasa, Markdown, Word, CSV atau JSON, dan yakin berkas Anda diproses untuk OCR dan kemudian dihapus secara otomatis.

Bagaimana pdf ke teks

1
Unggah PDF Anda
Tarik dalam PDF tunggal atau ramban; dokumen multi halaman didukung penuh.
2
Pilih mesin dan bahasa
Tetap dengan mesin cepat gratis untuk halaman tercetak, atau beralih ke mesin AI premium untuk scan, tabel, dan tulisan tangan; atur bahasa atau auto-detect.
3
Biarkan mengurutkan halaman
Halaman dengan lapis teks asli dibaca seketika dan losslessly; halaman yang dipindai pada resolusi tinggi, semua bergabung menjadi satu hasil.
4
Tinjau dan ekspor
Periksa teks terhadap setiap halaman, lalu salin atau download sebagai TXT, Markdown, DOCX, CSV, atau JSON.

Penggunaan umum

  • Para peneliti mengekstrak bagian - bagian dan kutipan dari artikel dan buku jurnal yang dipindai.
  • Pengacara dan paralegal mengubah berkas-berkas kasus scan dan kontrak menjadi teks yang dapat dicari.
  • Akuntan menarik angka dan baris item dari laporan keuangan dipindai.
  • Para aktivis mendigitalisasi catatan sejarah dan dokumen-dokumen yang tidak dicetak untuk pelestarian.
  • Pekerja kantor menggunakan kembali konten dari PDF lama tanpa membuka ulang halaman demi halaman.
  • Wartawan yang mencari nama dan istilah khusus dan nama pemerintah yang panjang dan pengadilan PDF.

Sering kali mengajukan pertanyaan

Setiap halaman diproses dan hasilnya digabung menjadi satu keluaran teks yang terus menerus dapat Anda salin atau download.

Halaman yang berisi lapisan teks asli diekstrak secara instan dan lossless, tanpa OCR dibutuhkan. Hanya halaman dipindai yang dijalankan melalui OCR, yang menjaga kualitas tinggi dan kecepatan cepat.

Anda dapat mencobanya secara gratis, dengan pemukuran per halaman dimana kredit sama halaman. Rekening gratis menambahkan ember halaman bulanan, dan membayar rencana dari 5/bulan menambahkan halaman lebih dan pemrosesan batch untuk dokumen besar.

Lebih dari 100, termasuk CJK, Arab, Cyrillic, dan Indic Script. kata-kata asing diterjemahkan sebagai ditulis dan tidak pernah diterjemahkan secara otomatis.

Halaman yang dipindai akan dirampungkan dan OCR'd secara otomatis; mesin AI premium disarankan untuk melakukan scan samar, tabel, atau tulisan tangan.

Berkas Anda diproses hanya untuk OCR dan kemudian dihapus secara otomatis. Kami tidak pernah menjual atau berbagi dokumen Anda.

Ya. POST PDF Anda ke /api/v1/ocer/dan menerima gabungan teks, kemungkinan menyatakan bahasa, tier mesin, dan format keluaran.

Hapus sandi atau buka PDF pada perangkat Anda terlebih dahulu, kemudian upload. Setelah file terbuka kita bisa membacanya, tapi kita tidak bisa melewatkan enkripsi pada dokumen terkunci.

Mesin premium memahami kolom dan urutan membaca, sehingga surat kabar, jurnal, dan tata letak dua-kolumn keluar dalam urutan yang tepat bukannya memiliki kolom berjalan bersama-sama.

Proses Batch tersedia pada rencana yang telah dibayar, sehingga Anda dapat mengantri PDFs dalam sekali proses. Pada tingkat bebas Anda mengunggah satu dokumen sekaligus.

Teks biasa (TXT), Markdown, Word (DOCX), PDF, CSV, dan JSON. Sebuah PDF yang dapat dicari menyimpan gambar halaman asli dengan lapis teks tersembunyi yang dapat dipilih yang ditambahkan di atas.

Tidak. upload Anda tidak tersentuh dan teks yang diekstrak dikirim sebagai hasil terpisah, jadi berkas sumber tidak pernah dimodifikasi.

Gunakan ini melalui API

Jalankan alat ini secara programmatis dengan POST tunggal. Lakukan otentikasi dengan token API dari halaman akun Anda.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=pdf-to-text"

Berkas 5 halaman atau lebih sedikit mengembalikan hasil inline; jika tidak jajak pendapat pekerjaan, maka unduh sebagai txt:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=txt" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.txt
Baca dokumen API →
Tingkatkan halaman ini
5.0/5 (0)

Saranmu membantu kita memperbaiki masalah.