PDF al teksto

Ŝanĝi skanitajn aŭ ciferecajn PDF-ojn al simpla teksto.

📄

Tregu kaj faligu, aŭ enmetu ekrankopion

Bildo, PDF, Word (DOCX) aŭ teksto - faldu, foliumu, enmetu, aŭ uzu URLon

🔒 Viaj dosieroj estas prilaboritaj private kaj aŭtomate forigitaj.

OCR.chat ekstraktas tekston el iu ajn PDF, ĉu ĝi estas cifereca eksporto aŭ stako de skanitaj paĝoj. Alŝutu plurpaĝan PDF kaj ĉiu paĝo estas traktita kaj kombinita en unu pura, kopipreta rezulto. Paĝoj kiuj jam enhavas realan tekstan tavolon estas legata tuj kaj senperdo, dum skanitaj paĝoj estas rulitaj tra OCR aŭtomate, do vi ĉiam ricevas la plej precizan tekston kiun la dosiero povas oferti.

Tiu PDF- al- teksta konvertilo estas farita por homoj kiuj laboras kun longaj dokumentoj: esploristoj elfosante malnovajn paperojn, advokatoj konvertante kazodosierojn al serĉebla teksto, kaj analizistoj eltirante ciferojn el skanitaj raportoj. Ĝi legas pli ol 100 lingvojn, montras la ekstraktitan tekston apud la origina paĝo por revizio, kaj neniam silente tradukas fremdajn vortojn, do multlingva PDF eliras ekzakte kiel ĝi eniris.

Ne necesas aliĝi por provi ĝin, kaj la rapida motoro traktas normalajn presitajn PDF-ojn senpage. Kiam dokumento havas densajn tabelojn, kolumnojn, aŭ manskribon, la altkvalita AI-motoro liveras pli altan precizecon. Elŝutu la rezulton kiel simplan tekston, Markdown, Word, CSV, aŭ JSON, kaj certiĝu, ke via dosiero estas traktita por OCR kaj poste forigita aŭtomate.

Kiel pdf al teksto

1
Alŝuti vian PDF
Ŝovu en ununuran PDF-on aŭ foliumu al ĝi; multpaĝaj dokumentoj estas plene subtenataj.
2
Elektu la motoron kaj lingvon
Konservu la senpagan rapidan motoron por presitaj paĝoj, aŭ ŝanĝu al la altkvalita AI-motoro por skanado, tabeloj, kaj manskribo; agordu lingvon aŭ aŭtomate malkovri.
3
Lasu ĝin ordigi la paĝojn
Paĝoj kun reala teksta tavolo estas legata tuj kaj senperdo; skanitaj paĝoj estas OCR ĉe alta rezolucio, ĉiuj kunfanditaj en unu rezulto.
4
Revizio kaj eksporto
Kontrolu la tekston kontraŭ ĉiu paĝo, poste kopiu ĝin aŭ elŝutu kiel TXT, Markdown, DOCX, CSV aŭ JSON.

Komunaj uzoj

  • La esploristoj elprenas pasaĝojn kaj citaĵojn el skanitaj ĵurnalaj artikoloj kaj libroj.
  • La aŭtoroj de la libroj kaj la libroj de la libroj estas listigitaj en la listo de la aŭtoroj.
  • La kalkulistoj eltiras ciferojn kaj liniajn erojn el skanitaj financaj deklaroj.
  • Arkivistoj ciferecigas historiajn registrojn kaj forprenitajn dokumentojn por konservado.
  • Oficejaj laboristoj reuzas enhavon el malnovaj PDF-oj sen retajpi paĝon post paĝo.
  • La ĵurnalistoj serĉas longajn registarajn kaj kortumajn PDF-ojn por specifaj nomoj kaj terminoj.

Oftaj demandoj

Jes. Ĉiu paĝo estas prilaborita kaj la rezultoj estas kombinitaj en unu kontinuan tekstan eligon, kiun vi povas kopii aŭ elŝuti.

Paĝoj kiuj enhavas realan tekstan tavolon estas ekstraktitaj tuj kaj senperdo, sen OCR bezonata. Nur skanitaj paĝoj estas ruligitaj tra OCR, kiu tenas kvaliton altan kaj rapidon altan.

Vi povas provi ĝin senpage, per paĝmezurado kie kreditoj egalas al paĝoj. Senpaga konto aldonas monatan paĝseĝon, kaj pagitaj planoj de $5/monato aldonas pli da paĝoj kaj batch-procesadon por grandaj dokumentoj.

Over 100, including CJK, Arabic, Cyrillic, and Indic scripts. Foreign words are transcribed as written and never auto-translated.

Jes. Skanitaj paĝoj estas rasterigitaj kaj aŭtomate rekonataj; la altnivela AI- motoro estas rekomendita por malhel- skanitaj paĝoj, tabeloj aŭ manskribo.

Via dosiero estas prilaborita nur por OCR kaj poste aŭtomate forigita. Ni neniam vendas aŭ kunhavas viajn dokumentojn.

Jes. POSTu vian PDF al /api/v1/ocr/ kaj ricevu la kombinitan tekston, opcione specifante lingvon, motornivelon, kaj eligon.

Forigu la pasvorton aŭ malŝlosu la PDF-on sur via aparato unue, poste alŝutu ĝin. Kiam dosiero estas malfermita, ni povas legi ĝin, sed ni ne povas eviti ĉifradon en ŝlosita dokumento.

La plej gravaj estas la sekvaj: La kolumnoj kaj la legi-ordo estas komprenataj de la AI-motoro, tiel ke gazetoj, revuoj kaj du-kolumnaj aranĝoj aperas en la ĝusta sinsekvo anstataŭ havi la kolumnojn kune.

Batch processing is available on paid plans, so you can queue multiple PDFs in one go. On the free tier you upload one document at a time.

Simple teksta (TXT), Markdown, Word (DOCX), serĉebla PDF, CSV, kaj JSON. Serĉebla PDF konservas la originalajn paĝbildojn kun kaŝita, elektebla teksta tavolo aldonita supre.

Ne. Via alŝuto estas netuŝita kaj la ekstraktita teksto estas liverita kiel aparta rezulto, do la fontodosiero neniam estas modifita.

Uzi tion per API

Lanĉi tiun ilon programe per unu POST. Aŭtentigu per la API-tokeno de via kontopaĝo.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=pdf-to-text"

Dosieroj de 5 paĝoj aŭ malpli redonas la rezulton enlinie; alie enketu la taskon, poste elŝutu ĝin kiel txt:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=txt" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.txt
Legi la API- dokumentaron →
Taksi tiun paĝon
5.0/5 (0)

Kion ni povus plibonigi? Via reago helpas nin solvi problemojn.