PDF kuni Tekst

Skaneeritud või digitaalsete PDF-de muutmine tavaliseks tekstiks.

📄

Lohistage ja visake või asetage pilt

Pilt, PDF, sõna (DOCX) või tekst - tilk, sirvimine, kleepimine või URL- i kasutamine

🔒 Teie faile töödeldakse privaatselt ja kustutatakse automaatselt.

OCR.chat väljavõtteid teksti igast PDF, kas see on digitaalne eksport või virna skaneeritud lehekülgi. Lae üles mitmeleheküljeline PDF ja iga lehekülg on töödeldud ja kombineeritud ühte puhas, kopeerimisvalmis tulemus. Lehed, mis juba sisaldavad tegelikku teksti kiht on lugeda koheselt ja kadumatult, samas skaneeritud lehekülgi töötab OCR automaatselt, nii et sa alati saada kõige täpsem tekst fail saab pakkuda.

See PDF teksti konverter on tehtud inimestele, kes töötavad pikki dokumente: teadlased kaevandavad vana paberid, paralegals muuta juhtumi faile otsitav tekst, ja analüütikud tõmbavad arvud skaneeritud aruanded. See loeb rohkem kui 100 keeles, näitab kaevandatud teksti kõrval originaal lehele läbivaatamiseks, ja kunagi vaikselt tõlgib välismaa sõnu, nii mitmekeelne PDF tuleb välja täpselt nii, nagu ta läks sisse.

Selleks pole vaja registreeruda ning kiire mootor kasutab standardseid PDF- sid tasuta. Kui dokumendil on tihedad tabelid, veerud või käekiri, pakub AI-mootor suuremat täpsust. Tulemuse saab alla laadida tavalise tekstina, märkimismärgina, Word, CSV või JSON ning olla kindel, et fail on töödeldud OCR jaoks ja kustutatud automaatselt.

Kuidas pdf kuni tekst

1
PDF- i laadimine
Lohistage ühte PDF- i või sirvige sinna; mitmeleheküljelised dokumendid on täielikult toetatud.
2
Vali mootor ja keel
Säti tasuta kiire mootor trükitud lehekülgi, või lülituda lisatasu AI mootori skaneerib, tabelid, ja käekiri; määrata keel või auto-tuvastus.
3
Las see sorteerib lehed
Tõelise tekstikihiga leheküljed loetakse koheselt ja kadudeta; skaneeritud leheküljed on OCR'd kõrge resolutsiooniga, kõik on ühendatud üheks tulemuseks.
4
Läbivaatamine ja eksport
Kontrolli teksti iga lehekülje kohta, siis kopeeri või alla laadida TXT, Markdown, DOX, CSV, või JSON.

Tavakasutus

  • Teadlased võtavad läbilõikeid ja tsitaate skaneeritud ajakirjadest ja raamatutest.
  • Advokaadid ja juristid muudavad skaneeritud juhtumifailid ja lepingud otsitavaks tekstiks.
  • Raamatupidajad, kes võtavad arve ja arve skaneeritud finantsaruandest välja.
  • Arhivistide digiteerimine ajaloolisi rekordeid ja out-of-print dokumente säilitamiseks.
  • Bürootöötajad kasutavad vana PDF-de sisu uuesti, ilma et lehte uuesti ümber kirjutataks.
  • Ajakirjanikud otsivad pikki valitsus- ja kohtuasutuste PDF-e konkreetsete nimede ja terminite saamiseks.

Korduma kippuvad küsimused

Jah. Iga leht on töödeldud ja tulemused on ühendatud ühte pidev teksti väljund saab kopeerida või alla laadida.

Lehed, mis sisaldavad tõelist tekstikihti on ekstraheeritud koheselt ja kadudeta, ilma OCR vaja. Ainult skaneeritud lehekülgi läbi OCR, mis hoiab kvaliteedi kõrge ja kiirus kiire.

Saate proovida seda tasuta, iga lehe kohta mõõtmine, kus krediiti võrdse lehekülge. Tasuta konto lisab kuu leht ämber, ja makstud plaanid $5/kuu lisada rohkem lehti ja partii töötlemise suurte dokumentide.

Üle 100, sealhulgas CJK, araabia, kirillitsa ja indika skriptid. Võõrsõnad on transkribeeritud nagu kirjutatud ja kunagi auto-tõlgitud.

Jah. Skaneeritud leheküljed rasteriseeritud ja OCR'd automaatselt; premium AI mootor on soovitatav nõrga skaneerimise, tabelid, või käekiri.

Teie fail töödeldakse ainult OCR ja seejärel automaatselt kustutatud. Me kunagi müüa või jagada oma dokumente.

Jah. POSTA PDF aadressile /api/v1/ocr / ja saada kombineeritud tekst, mis määrab valikuliselt keele, mootori taseme ja väljundi vormingu.

Eemalda parool või ava kõigepealt seadmes PDF, siis laadi see üles. Kui fail on avatud, saame seda lugeda, kuid me ei saa lukustatud dokumendi krüptimisest mööda minna.

Premium AI mootor mõistab veergude ja lugemise järjekorras, nii ajalehe, ajakirja ja kahe veeru paigutused tulevad välja õiges järjekorras asemel, et lasta veerud koos.

Partii töötlemine on saadaval tasuliste plaanide, nii et saate järjekorda mitu PDF ühe go. Vabal tasandil laadite ühe dokumendi korraga.

Klaartekst (TXT), märkimiskood, sõna (DOCX), otsitav PDF, CSV ja JSON. Otsitav PDF hoiab originaallehekülje pilte peidetud, valitav tekstikiht lisatud peal.

Ei. Sinu üleslaadimine jäetakse puutumata ja väljavõte saadetakse eraldi tulemusena, nii et lähtefaili ei muudeta kunagi.

Kasuta seda API kaudu

Käivita see tööriist programmeeritult ühe postiga. Autentida API märgiga konto leheküljelt.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=pdf-to-text"

5 või vähem leheküljelised failid tagastavad tulemuse reana; vastasel korral küsitlevad tööd, laadivad selle alla kui txt:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=txt" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.txt
API docs lugemine →
Hinda seda lehekülge
5.0/5 (0)

Mida me saaksime parandada? Teie tagasiside aitab meil lahendada küsimusi.