PDF í texta

Snúðu skönnuðum eða stafrænum PDF-skjölum í venjulegt texta.

📄

Dragðu og slepptu eða límdu skjámynd

Mynd, PDF, Word (DOCX) eða texti - sleppa, fletta, líma eða nota slóð

🔒 Skrárnar þínar eru unnar í einkaeign og eytt sjálfkrafa.

OCR.chat dregur texta úr hvaða PDF, hvort sem það er stafræn útflutningur eða stafla af skannaðar síður. Hlaða multi-síðu PDF og hver blaðsíða er unnin og sameinuð í einn hreinn, afrita tilbúinn niðurstöðu. Síður sem þegar innihalda raunverulegt textalag eru lesin strax og lossless, en skannaðar síður eru keyrt í gegnum OCR sjálfkrafa, þannig að þú færð alltaf nákvæmasta texta skrá sem hægt er að bjóða.

Þetta PDF til texta breytir er gert fyrir fólk sem vinnur með löngum skjölum: vísindamenn jarðganga gömlu pappír, paralegals snúa mál skrár í leitartexta, og sérfræðingar draga tölur úr skannað skýrslur. Það les meira en 100 tungumál, sýnir útdráttur texta við hliðina á upprunalegu síðu til endurskoðunar, og aldrei hljóðlega þýðir erlend orð, svo fjöltyngdur PDF kemur út nákvæmlega eins og það fór inn.

Það er engin skráning nauðsynleg til að prófa það og hratt vélin meðhöndlar venjuleg prentuð PDF ókeypis. Þegar skjal hefur þétt töflur, dálka eða handskrift, Premium AI vélin veitir meiri nákvæmni. Hlaða niður niðurstöðu sem venjulegur texti, Markdown, Word, CSV eða JSON, og vera viss um að skráin þín er unnin fyrir OCR og síðan eytt sjálfkrafa.

Hvernig á að nota pdf í texta

1
Hladdu upp PDF skjalinu þínu
Dragðu í einn PDF eða flettu að því; multi-síðu skjöl eru fullkomlega studd.
2
Veldu vél og tungumál
Haltu áfram með ókeypis hraða vél fyrir prentuðu síður, eða skipta yfir í hágæða AI vél fyrir skönnun, töflur og handskrift; setja tungumál eða sjálfvirkt greina.
3
Leyfðu því að raða síðunum
Síður með alvöru texta lag eru lesin þegar í stað og lossless; skannaðar síður eru OCR'd í hárri upplausn, allt sameinast í einni niðurstöðu.
4
Skoða og flytja út
Athugaðu textann á hverri síðu, afritaðu það eða hlaða niður sem TXT, Markdown, DOCX, CSV eða JSON.

Algengar notkunarleiðir

  • Vísindamenn draga út kafla og tilvitnanir úr skönnuðum tímaritum og bókum.
  • Lögfræðingar og paralegals umbreyta skönnuð mál skrár og samninga í leitartexta.
  • Bókhaldsmenn draga tölur og línu atriði úr skannaðri reikningsskila.
  • Skjalasafn stafrænna sögulegra skráa og útprentuð skjöl til varðveislu.
  • Skrifstofa starfsmenn endurnýta efni frá gömlum PDF án retyping síðu eftir síðu.
  • Blaðamenn leita að löngum stjórnvöldum og dómstólum PDF fyrir tilteknar nöfn og hugtök.

Algengar spurningar

Já, hver blaðsíða er unnin og niðurstöðurnar eru sameinaðar í einn samfelldan texta sem hægt er að afrita eða hlaða niður.

Síður sem innihalda raunverulegt textalag eru dregnar út þegar í stað og taplaust, án þess að OCR sé þörf. Aðeins skannaðar síður eru keyrðar í gegnum OCR, sem heldur gæðum háum og hraða hratt.

Þú getur prófað það ókeypis, með mælikvarða á síðu þar sem innistæður eru jafnar síðum. Ókeypis reikningur bætir við mánaðarlega síðufötu og greiddar áætlanir frá $ 5 / mánuði bæta við fleiri síðum og hópsvinnslu fyrir stór skjöl.

Yfir 100, þar á meðal CJK, arabísku, kýrillísku og indversku skriftum.Erlend orð eru ritaðar eins og skrifað og aldrei sjálfvirkt þýtt.

Skannaðar síður eru rasterized og OCR'd sjálfkrafa; Premium AI vél er mælt með fyrir dauf skanna, töflur, eða handskrift.

Skráin þín er unnin fyrir OCR aðeins og síðan eytt sjálfkrafa.Við seljum aldrei eða deila skjölin þín.

POST PDF til /api/v1/ocr/ og fá sameinaða texta, valfrjáls tilgreina tungumál, vél tier, og framleiðsla snið.

Fjarlægðu lykilorðið eða opnaðu PDF í tækinu þínu fyrst, þá hlaða því upp. Þegar skrá er opin getum við lesið hana, en við getum ekki framhjá dulkóðun á læstu skjali.

The Premium AI vél skilur dálka og lestur röð, þannig að dagblað, tímarit og tveggja dálka skipulag koma út í réttri röð í stað þess að fá dálka hlaupa saman.

Hópur vinnsla er í boði á greiddum áætlunum, svo þú getur bíða marga PDF í einu.Á frjálsu stigi hleður þú upp einu skjali í einu.

Venjulegur texti (TXT), Markdown, Word (DOCX), leitarhæf PDF, CSV og JSON.Leitanlegan PDF heldur upprunalegu síðumyndirnar með falinn, valhæfan texta lag bætt efst.

Nei, upphleðslan þín er óbreytt og útdráttur textans er afhent sem sérstakt niðurstaða, þannig að upprunalega skráin er aldrei breytt.

Notaðu þetta í gegnum API

Keyrðu þetta tól forritunarlega með einum POST. Auðkenni með API tákninu frá reikningssíðunni þinni.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=pdf-to-text"

Skrár sem eru 5 síður eða færri skila niðurstöðunni í línu; annars er hægt að kanna verkið og sækja það sem txt:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=txt" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.txt
Lestu API skjölin →
Gefa þessari síðu einkunn
5.0/5 (0)

Hvað gætum við bætt? Ábendingar þínar hjálpa okkur að laga vandamál.