PDF į tekstą

Skenuoti arba skaitmeniniai PDF į paprastą tekstą.

📄

Tempkite ir numeskite arba įklijuokite ekrano nuotrauką

Vaizdas, PDF, Word (DOCX) arba tekstas - lašas, naršyti, įklijuoti, arba naudoti URL

🔒 Jūsų failai tvarkomi privačiai ir ištrinami automatiškai.

OCR.chat ištraukia tekstą iš bet kurio PDF, ar tai skaitmeninis eksportas ar skenuotų puslapių kamino. Įkelkite daugialapį PDF ir kiekvienas puslapis yra apdorojamas ir sujungiamas į vieną švarų, kopijavimo paruoštas rezultatą. Puslapiai, kurie jau turi tikrą teksto sluoksnis yra skaityti nedelsiant ir netekusi nuostolių, o nuskaitytas puslapiai veikia per OCR automatiškai, todėl jūs visada gauti tiksliausią tekstą, kurį failas gali pasiūlyti.

Šis PDF į tekstą konverteris yra skirtas žmonėms, kurie dirba su ilgais dokumentais: mokslininkai kasimo senus dokumentus, parajuotieji konvertuoja bylos failus į paieškos tekstą, ir analitikai, traukiant skaičius iš nuskaitytų ataskaitų. Jis skaito daugiau nei 100 kalbų, rodo išgautas tekstas šalia pradinio puslapio apžvalgai, ir niekada tyliai išversta užsienio žodžius, todėl daugiakalbis PDF išeina tiksliai, kaip ji nuėjo.

Nėra jokio ženklo, kurio reikia bandyti, ir greito variklio rankenos spausdinami PDF už laisvą. Kai dokumente yra tankūs stalai, stulpeliai ar rankraštis, premium AI variklis užtikrina didesnį tikslumą. Atsisiųskite rezultatą paprastu tekstu, Markdown, Word, CSV arba JSON ir pailsėkite užtikrindami, kad failas bus apdorotas OCR ir automatiškai ištrintas.

Kaip vartoti pdf į tekstą

1
Atsiųskite PDF
Vilkite viename PDF arba naršykite į jį; kelių puslapių dokumentai yra visiškai palaikomi.
2
Pasirinkite variklį ir kalbą
Stick su nemokamai greitai variklio spausdintų puslapių, arba pereiti prie aukščiausios AI variklio skenavimas, lentelės, ir ranka rašymas; nustatyti kalbą ar auto-detektoriaus.
3
Tegu sutvarko puslapius
Puslapiai su realiu teksto sluoksniu yra skaityti nedelsiant ir be nuostolių; nuskaitytos puslapiai yra OCR'd aukštos raiškos, visi sujungti į vieną rezultatą.
4
Peržiūra ir eksportas
Patikrinkite tekstą prieš kiekvieną puslapį, tada nukopijuokite jį arba atsisiųskite kaip TXT, Markdown, DOCX, CSV, arba JSON.

Įprastas naudojimas

  • Tyrinėtojai išrašinėja ištraukas bei cituoja iš nuskaitytų žurnalų straipsnių ir knygų.
  • Teisininkai ir paralegals konvertuoja skenuotų bylų failus ir sutartis į paieškos tekstą.
  • Apskaitos subjektai, pašalinantys duomenis ir eilučių straipsnius iš nuskaitytų finansinių ataskaitų.
  • Archivams suskaitmeninant istorinius įrašus ir nespausdintus dokumentus, skirtus saugoti.
  • Biuro darbuotojai pakartotinai naudoja senų PDF turinį be tinklalapio tipo patvirtinimo.
  • Žurnalistai, ieškantys ilgo valdžios ir teismo PDF konkrečių pavadinimų ir terminų.

Dažnai užduodami klausimai

Taip. Kiekvienas puslapis yra apdorojamas ir rezultatai yra sujungti į vieną nepertraukiamo teksto išvestį galite kopijuoti arba atsisiųsti.

Puslapiai, kuriuose yra tikras teksto sluoksnis, išgaunami nedelsiant ir be nuostolių, be OCR reikia. Per OCR veikia tik nuskaityti puslapiai, kurie užtikrina aukštą ir greitą kokybę.

Galite išbandyti jį nemokamai, su per-puslapis matavimo kur kreditai lygūs puslapiai. Nemokama sąskaita prideda mėnesinį puslapį kibirkštis, ir mokamas planus nuo $5 mėnesių pridėti daugiau puslapių ir partijos perdirbimą dideliems dokumentams.

Per 100, įskaitant CJK, Arabų, Kirilica, ir indikų scenarijai. Užsienio žodžiai yra tranzitiškai kaip raštu ir niekada automatiškai išversti.

Taip. Skenuoti puslapiai yra rastralizuojami ir OCR'd automatiškai; premium AI variklis rekomenduojamas silpnas nuskaitymo, stalai, ar rašto.

Jūsų failas tvarkomas tik OCR ir tada ištrinamas automatiškai. Mes niekada parduodame ar dalinamės jūsų dokumentais.

Taip.Padėkite savo PDF į /api/v1/och/ ir gauti bendrą tekstą, neprivalomai nurodant kalbą, variklio pakopą, ir išvesties formatą.

Pašalinti slaptažodį arba atrakinti PDF į savo įrenginį, tada įkelti jį. Atidarius failą, mes galime perskaityti jį, bet mes negalime apeiti šifravimo užrakintame dokumente.

Priemoka AI variklis supranta stulpelius ir skaitymo tvarką, todėl laikraštis, žurnalas, ir dviejų stulpelių išdėstymai išeina teisinga seka, o ne turintys stulpeliai paleisti kartu.

Partijos apdorojimas yra prieinamas apmokamų planų, todėl galite eilėje kelis PDF vienu metu. Dėl nemokamo lygio įkelti vieną dokumentą vienu metu.

Paprastas tekstas (TXT), Marcdown, Word (DOCX), paieškos PDF, CSV, ir JSON. Ieškomas PDF saugo originalius puslapio vaizdus su paslėptu, pasirenkamu teksto sluoksnis pridėtas viršuje.

Ne. Jūsų įkeltas tekstas liko nepaliestas, o išgautas tekstas pateikiamas kaip atskiras rezultatas, todėl pradinio kodo failas niekada nekeičiamas.

Naudoti šį failą per API

Paleiskite šį įrankį programiškai vienu podėliu. Autentifikuokite API raktu iš savo paskyros puslapio.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=pdf-to-text"

Failai 5 puslapių ar mažiau grąžinti rezultatą į line; kitaip apklausti darbą, tada parsisiųsti jį kaip txt:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=txt" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.txt
Perskaityk API dokumentus →
Įvertinti šį puslapį
5.0/5 (0)

Ką galėtume pagerinti? Jūsų atsiliepimai padeda išspręsti problemas.