Prohledatelný PDF

Přidejte volitelnou textovou vrstvu do skenovaných PDFs.

🔍

Přetáhněte a pusťte, nebo vložte screenshot

Obrázek, PDF, Word (DOCX) nebo text - drop, procházení, vložit nebo použít URL

🔒 Vaše soubory jsou zpracovávány soukromě a automaticky smazány.

Vytvořte si PDF vyhledávatelný přidáním neviditelné OCR textovou vrstvu přes vaše skenované stránky. Naskenovaný dokument je opravdu jen hromada obrázků, takže nemůžete najít, vybrat nebo zkopírovat jediné slovo v něm. OCR.chat čte text a klade jej přesně přes původní sken, otáčení plochý obraz do PDF můžete hledat a vybrat v každém čtenáři.

To je nástroj pro archivaci a správu dokumentů, kde je možné najít smlouvu podle doložky nebo fráze přes tisíce stránek je celý bod. Je to nezbytné pro právní objev, uchovávání záznamů a digitalizaci kartotéky, a to udržuje vaše stránky vypadat přesně tak, jak skenované, protože textová vrstva je neviditelná a původní obraz je nedotčen.

OCR.chat je zdarma vyzkoušet bez přihlášení. Vyhledatelný PDF běží na rychlé úrovni pro tištěné dokumenty ve více než 100 jazycích, takže multi-page skenování je zpracován rychle a stahován jako standardní PDF, který funguje v Acrobat, Náhled, Váš prohlížeč, a jakýkoli jiný prohlížeč, s full-text vyhledávání a kopírování pasty postavené.

Jak se prohledatelný pdf

1
Nahrát naskenovaný PDF
Zadejte naskenovaný PDF nebo obrázek stránky, kterou chcete, aby prohledat.
2
Spustit OCR
OCR.chat čte každou stránku a pozice, která je známa přesně tam, kde se objeví na skenu.
3
Získejte neviditelnou textovou vrstvu
Uznaný text je přidán jako neviditelná vrstva nad původní obraz, takže stránka vypadá identicky, ale nyní je vyhledávatelná.
4
Stáhnout vyhledávací PDF
Uložte standardní PDF, které můžete vyhledávat, vybírat a kopírovat z Acrobat, Preview, prohlížeče nebo jakéhokoliv čtenáře.

Společné použití

  • Archiv skenoval smlouvy, záznamy a korespondenci, takže můžete najít jakýkoli dokument podle jeho obsahu.
  • Připravte skenované exponáty a spisy k právnímu objevu a full-textové recenzi.
  • Digitalizovat kartotéku papírových dokumentů do vyhledávatelné, budoucnost-proof PDF knihovny.
  • Udělat skeny knih, manuálů a referenčních materiálů, které se hledají pro výzkum a citace.
  • Přidat vyhledávací text do skenovaných formulářů a aplikací, aby zaměstnanci mohli rychle najít položky.
  • Vybudovat prohledatelnou znalostní základnu z naskenovaných faktur, výpisů a účtenek pro audity.

Často kladené otázky

OCR.chat čte text na každé naskenované stránce a přidává jej jako neviditelnou vrstvu zarovnanou nad původním obrazem. Stránka vypadá úplně stejně, ale skrytý text umožňuje každému čtenáři PDF najít, vybrat a kopírovat slova z něj.

Ne. Původní skenovaný obrázek je zachován nedotčen a text OCR se nachází neviditelně nahoře, takže dokument vypadá stejně jako to, co jste nahráli, když jste se stali plně vyhledávatelnými.

Jakýkoliv standardní čtečka. Výstupem je obyčejný PDF, takže vyhledávání, výběr a kopírování pasty práce v Adobe Acrobat, Apple Preview, váš webový prohlížeč, a další běžné prohlížeče.

Ano. Každá stránka v PDF je zpracována a textová vrstva je přidána do celého dokumentu, takže hledání funguje napříč celým dokumentem, nejen první stránku.

Rychlá úroveň je vhodná pro tištěné skenování a produkuje spolehlivou textovou vrstvu pro vyhledávání. Protože text je neviditelný, občas se nepřečte, jak stránka vypadá, a můžete si prohlédnout uznávaný text bok po boku před stažením.

Prohledávací textová vrstva podporuje více než 100 jazyků, včetně CJK, Arabštiny, Cyrillic a Indic skriptů. Můžete nahrát skenované PDF, stejně jako PNG, JPG, a TIFF obrázky, a cizí text je transcribován jako psaný, nikdy přeložen.

Jen mírně. Neviditelná textová vrstva je lehká ve srovnání s obrázky stránek, takže vyhledávaná PDF je obvykle blízko k původnímu skenu, spíše než balónkování. Viditelná data jsou zachována tak, jak je.

Ano, i když byt, rovnoměrně osvětlený, přímé-na záběru nejlépe čte. Jasná telefonní fotografie tištěné stránky funguje dobře, těžké stíny, oslnění, nebo strmý úhel může snížit přesnost, takže by se na stránku a vyhnout zkosení, kde můžete.

Čisté tištěné skeny dávají nejspolehlivější textovou vrstvu. Faded, zkosené, nebo hlučné stránky stále získat vyhledávatelný text, ale s větší pravděpodobností chybný čtení. Vzhledem k tomu, text je neviditelný, zatoulaná chyba nikdy nemění, jak stránka vypadá, a můžete si prohlédnout uznávaný text před stažením.

Jednotlivé soubory běží rychle, a delší nebo více souborů práce proces v pozadí. Bezplatné použití zahrnuje měsíční příspěvek na stránku; placené plány od $5/mo přidat více stránek (kredity se počítají jako stránky) a dávkové zpracování tak, aby můžete udělat celý archiv prohledat najednou.

Ano. REST API je k dispozici na placených plánech, takže můžete poslat naskenované PDF a získat vyhledávací PDF zpět z vlastního dokumentu workflow bez nahrávání každé ručně.

Můžete to vyzkoušet zdarma bez přihlášení, a volný účet zahrnuje měsíční příspěvek na stránku, s placenými plány od $5/mo pro více stránek, zpracování šarže, a API přístup. Soubory jsou zpracovány pouze pro OCR, smazány automaticky, a nikdy neprodal nebo sdílen.

Použijte to přes API

Spusťte tento nástroj programově pomocí jediného POST. Ověřte si to s API žetonem ze stránky vašeho účtu.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=searchable-pdf"

Soubory 5 stránek nebo méně vrátit výsledek inline; jinak anketa práce, pak stáhnout jako pdf:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=pdf" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.pdf
Přečtěte si dokumenty API →
Ohodnotit tuto stránku
5.0/5 (0)

Vaše zpětná vazba nám pomáhá řešit problémy.