PDF-ről szövegre

A beszkennelt vagy digitális PDF-eket egyszerű szövegré alakítjuk.

📄

Húzd és ejtsd, vagy ragaszts egy képernyőképet

Kép, PDF, Word (DOCX) vagy szöveg - csepp, böngészés, beillesztés, vagy használja URL

🔒 A fájlokat privátan feldolgozzuk és automatikusan töröljük.

OCR.chat kivonat szöveg bármely PDF, legyen az egy digitális export vagy egy halom szkennelt oldalak. Feltöltése egy többoldalas PDF és minden oldal feldolgozzák és kombinálják egy tiszta, másolásra kész eredmény. Lapok, amelyek már tartalmaznak egy valódi szöveg réteg azonnal és veszteség nélkül, míg a beszkennelt oldalak futnak OCR automatikusan, így mindig kap a legpontosabb szöveg a fájlt kínál.

Ez a PDF szövegkonverter olyan embereknek készült, akik hosszú dokumentumok: kutatók bányászata régi papírok, paralegális kapcsolja az eset fájlokat kereshető szöveg, és elemzők húzza ki számokból szkennelt jelentéseket. Több mint 100 nyelven, mutatja a kivont szöveget mellett az eredeti oldalon felülvizsgálat, és soha nem csendesen lefordítja idegen szavakat, így egy többnyelvű PDF jelenik meg pontosan, ahogy ment.

Nincs szükség regisztrációra, hogy kipróbálja, és a gyors motor kezeli a szabványos nyomtatott PDF-eket ingyen. Ha egy dokumentum sűrű táblázatok, oszlopok, vagy kézírás, a prémium MI motor nagyobb pontosságot biztosít. Töltse le az eredményt egyszerű szöveg, Markdown, Word, CSV, vagy JSON, és nyugodt lehet, hogy a fájlt feldolgozzák OCR, majd automatikusan törölték.

Hogyan kell pdf-ről szövegre

1
PDF feltöltése
Húzd be egyetlen PDF-be vagy böngészd meg; a többoldalas dokumentumok teljes mértékben támogatottak.
2
Válassza ki a motort és a nyelvet
Maradjon a nyomtatott oldalak ingyenes gyors motorjánál, vagy kapcsoljon a prémium MI motorra a szkenneléshez, asztalokhoz és kézíráshoz; állítson be egy nyelvet vagy automatikus detektálást.
3
Hadd rendezze el a lapokat.
Az igazi szövegrétegű oldalakat azonnal és veszteségmentesen olvassák; a beszkennelt oldalakat nagy felbontásban OCR'd-el látják, mindegyik egy eredménybe olvad.
4
Felülvizsgálat és kivitel
Ellenőrizze a szöveget minden oldalhoz, majd másolja le vagy töltse le TXT, Markdown, DOCX, CSV vagy JSON néven.

Közös felhasználás

  • Kutatók kivonatok és idézetek szkennelt folyóirat cikkek és könyvek.
  • Ügyvédek és jogi asszisztensek átvizsgált ügyiratokat és szerződéseket kereshető szövegre.
  • A könyvelők kihúzzák a számokat és sorokat a leolvasott pénzügyi kimutatásokból.
  • Archivisták digitalizálják a történelmi feljegyzéseket és a megőrzéshez használt papírokat.
  • Irodai dolgozók újrahasználata tartalmak régi PDF-ek nélkül újragépelés oldalról oldalra.
  • Újságírók keresi a hosszú kormány és bíróság PDF-ek konkrét nevek és kifejezések.

Gyakran feltett kérdések

Igen. Minden oldalt feldolgoznak, és az eredményeket egy folyamatos szöveges kimenetbe kombinálják, amit le lehet másolni vagy le lehet tölteni.

Az igazi szövegréteget tartalmazó oldalakat azonnal és veszteségmentesen kivonják, OCR nélkül. Csak a szkennelt oldalak futnak át az OCR-en, ami gyors és gyors minőséget biztosít.

Kipróbálhatja ingyen, egy oldalonkénti méréssel, ahol a kreditek egyenlő oldalak. Egy ingyenes számla hozzáad egy havi oldal vödröt, és fizetett tervek $5 hónap hozzá több oldalt és tétel feldolgozás nagy dokumentumok.

Több mint 100, beleértve a CJK, arab, cirill és indic szkripteket. Külföldi szavak átírva, mint írott és soha nem automatikus fordítás.

Igen. A letapogatott oldalakat eltörlik és automatikusan OCR-t használ; a prémium MI motort ajánlott a gyenge letapogatásokhoz, asztalokhoz vagy kézíráshoz.

A fájlt csak OCR-re feldolgozzuk, majd automatikusan töröljük. Sosem adjuk el vagy osztjuk meg a dokumentumait.

Igen. PDF-ét /api/v1/ocr/-re kell küldeni, és megkapjuk a kombinált szöveget, amely opcionálisan meghatározza a nyelvet, a motort és a kimeneti formátumot.

Távolítsa el a jelszót, vagy először a PDF-t az eszközön, majd töltse fel. Ha egy fájl megnyílt, elolvashatjuk, de nem tudjuk megkerülni a titkosítást egy lezárt dokumentumon.

A prémium MI motor érti az oszlopokat és az olvasási sorrendet, így az újság, a napló és a kétoszlopos elrendezések a megfelelő sorrendben jönnek ki ahelyett, hogy az oszlopok együtt futnának.

A kötegelés a fizetett terveken keresztül érhető el, így egyszerre több PDF-t is fel tud sorban állni. Az ingyenes Tier-en egyszerre egy dokumentumot tölt fel.

Egyszerű szöveg (TXT), Markdown, Word (DOCX), kereshető PDF, CSV, és JSON. A kereshető PDF tartja az eredeti oldal képeket rejtett, kiválasztható szöveges réteg hozzáadva a tetején.

Nem. A feltöltés érintetlen marad, és a kivont szöveget külön eredményként szállítják, így a forrásfájlt soha nem módosítják.

Használja ezt az API-n keresztül

Futtassa ezt az eszközt programmatically egy POST-tal. Authenticate with the API token from your account page.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=pdf-to-text"

5 vagy kevesebb oldal fájlja adja vissza az eredményt; egyébként szavazzon a feladatra, majd töltse le txt:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=txt" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.txt
Olvassa el az API dokumentációit →
Szavazz erre az oldalra
5.0/5 (0)

Mit lehetne javítani? A visszajelzés segít nekünk a problémák megoldásában.