PDF uz tekstu

Apgrieziet skenētos vai digitālos PDF vienkāršu tekstu.

📄

Velciet un nometiet, vai ielīmējiet ekrāna attēlu

Attēls, PDF, Word (DOCX) vai teksts - piliens, pārlūkot, pasta, vai izmantot URL

🔒 Jūsu faili tiek apstrādāti privāti un dzēsti automātiski.

OCR.chat izraksta tekstu no jebkura PDF, vai tas ir digitālais eksports vai scam skenētu lapu. Uzlādēt daudzlapu PDF un katru lapu tiek apstrādāts un apvienots vienā tīru, kopiju gatavs rezultāts. Lapas, kas jau satur reālu teksta slāni tiek lasīts uzreiz un bez zaudējumiem, kamēr skenēti lapas darbojas caur OCR automātiski, tāpēc jūs vienmēr iegūt visprecīzāko tekstu, ko fails var piedāvāt.

Šis PDF uz teksta pārveidotājs ir paredzēts cilvēkiem, kas strādā ar gariem dokumentiem: pētnieki kalnrūpnieki vecus dokumentus, parajutiesistika pārvērš lietu failus meklētā tekstā, un analītiķi, kas velkot skaitļus no skenētiem ziņojumiem. Tas lasa vairāk nekā 100 valodas, parāda iegūto tekstu blakus sākotnējā lapā pārskata, un nekad klusi tulko svešvalodā vārdus, tāpēc daudzvalodīgs PDF nāk tieši tā aizgāja.

Nav nepieciešams to izmēģināt, un ātrās dzinēja rokturiem ir drukāti PDF par brīvu. Ja dokumentā ir blīvi galdi, kolonnas vai roku rakstīšana, premium AI dzinējs nodrošina augstāku precizitāti. Lejupielādēt rezultātu kā vienkāršu tekstu, Markdown, Word, CSV vai JSON, un būt droši, ka fails tiek apstrādāts OCR un pēc tam automātiski dzēsts.

Kā lietot pdf uz tekstu

1
Ielādējiet PDF
Velciet vienā PDF vai pārlūkojiet uz to; daudzlapu dokumenti ir pilnībā atbalstīti.
2
Izvēlieties motoru un valodu
Pieturiet ar bezmaksas ātri dzinējs drukātas lapas, vai pārslēgties uz premium AI dzinējs skenēšanas, tabulas, un rokraksts; noteikt valodu vai auto-noteikšanu.
3
Lai sašķiro lapas
Lapas ar reālu teksta slāni nolasa uzreiz un bez zaudējumiem; skenētās lapas ir OCR'd pie augstas izšķirtspējas, visas apvienotas vienā rezultā.
4
Pārskatīšana un eksports
Pārbaudiet tekstu pret katru lapu, tad kopēt to vai lejupielādēt kā TXT, Markdown, DOCX, CSV, vai JSON.

Kopīgi lietojumi

  • Zinātnieki izgūst fragmentus un citējumus no skenētiem žurnāliem rakstiem un grāmatām.
  • Juristi un paralegiāli, pārveidojot skenētās lietu datnes un līgumus par meklējamu tekstu.
  • Grāmatveži, kas skenētos finanšu pārskatos svītro skaitļus un posteņus.
  • Arhivisti, kas digitalizē vēsturiskos ierakstus un bezdrukātus dokumentus, lai tos saglabātu.
  • Biroja darbinieki atkārtoti izmanto saturu no vecajiem PDF bez pārrakstīšanās lapas pēc lapas.
  • Žurnālisti meklē ilgs valdības un tiesas PDF par konkrētiem vārdiem un terminiem.

Bieži uzdotie jautājumi

Jā. Katra lapa tiek apstrādāta un rezultāti tiek apvienoti vienā nepārtrauktā teksta izvade, kuru varat kopēt vai lejupielādēt.

Lapas, kas satur reālu teksta slāni, tiek izspiestas uzreiz un bez zudumiem, bez OCR nepieciešams. Tikai skenētās lapas tiek palaistas caur OCR, kas uztur kvalitatīvu augstu un ātru.

Jūs varat mēģināt to bez maksas, ar per-lapu mērīšanu, kur kredīti vienādas lapas. Bezmaksas konts pievieno mēneša lapu spaini, un apmaksāti plāni no $5 mēnesī pievienot vairāk lapas un partiju apstrādi lieliem dokumentiem.

Vairāk nekā 100, ieskaitot CJK, arābu, Kirilica, un indiku skripti. Svešvalodas ir trancētas kā rakstīts un nekad auto-tulkoti.

Jā. Skenētas lapas ir rastralized un OCR'd automātiski; premium AI dzinējs ir ieteicams vāja skenēšana, tabulas, vai rokraksts.

Jūsu fails tiek apstrādāts tikai OCR un pēc tam automātiski dzēsts. Mēs nekad pārdot vai kopīgot jūsu dokumentus.

Jā.Post savu PDF uz /api/v1/ocr / un saņemt kombinēto tekstu, pēc izvēles norādot valodu, motora līmeni, un izejas formātu.

Noņemiet paroli vai vispirms atbloķējiet ierīces PDF, pēc tam to augšupielādējiet. Pēc faila atvēršanas mēs to varam izlasīt, bet mēs nevaram apiet šifrēšanu uz bloķēta dokumenta.

Prēmija AI dzinējs saprot kolonnas un lasīšanas secībā, tāpēc laikraksts, žurnāli, un divu kolonnu izkārtojumi nāk klajā pareizajā secībā, nevis kam kolonnas darboties kopā.

Partijas apstrāde ir pieejama maksas plānos, lai jūs varētu rindā vairākas PDF vienā laikā. Bezmaksas līmenī jūs augšupielādēt vienu dokumentu vienlaicīgi.

Vienkāršs teksts (TXT), Marcdown, Word (DOCX), meklējams PDF, CSV, un JSON. Meklējams PDF saglabā oriģinālos lapu attēlus ar slēptu, izvēlamu teksta slāni, kas pievienots augšpusē.

Nē. Jūsu augšupielāde ir atstāta neskarta un izgūtais teksts tiek piegādāts kā atsevišķs rezultāts, tāpēc pirmkoda fails nekad netiek mainīts.

Lietot šo, izmantojot API

Palaist šo rīku programmātiski ar vienu point. Autentificēties ar API žetonu no sava konta lapas.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=pdf-to-text"

Faili 5 lapas vai mazāk atgriezt rezultātu inline; citādi aptaujā darbu, tad lejupielādēt to kā txt:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=txt" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.txt
Izlasiet API dokumentus →
Novērtēt šo lapu
5.0/5 (0)

Ko mēs varētu uzlabot? Jūsu atsauksmes palīdz mums atrisināt problēmas.