סעלעקציע:

Add a selectable text layer to scanned PDFs.

🔍

סעלעקציע:

בילד, PDF, וואָרט (DOCX) אָדער טעקסט: לאָז אַראָפּ, בלײַב אױף, קלײַב אױס, אָדער ניצע אַ URL

🔒 די טעקע־נאָמען זײַנען ניט־פֿאַרװײַליקע

Make a PDF searchable by adding an invisible OCR text layer over your scanned pages. A scanned document is really just a stack of images, so you cannot find, select, or copy a single word in it. OCR.chat reads the text and lays it precisely over the original scan, turning a flat image into a PDF you can search and select in any reader.

דאָס איז אַ מכשיר פֿאַר ארקיװירונג און דאָקומענט־באַהאַנדלונג, װוּ די מעגלעכקײט צו געפֿינען אַ קאָנטראַקט דורך אַ קלאַס אָדער אַ שריפֿטצײכן איבער טויזנטער זײַטן איז דער עיקר. דאָס איז נייטיק פֿאַר געזעץלעכע אױפֿפֿירונג, אױסגעפֿירטע אױספֿירונגען און דיגיטאַליזירטע פֿאָרמאַטירונגען, און עס װײַזט אױס די זײַטן פּונקט ווי געסקאַנערט, װײַל דער טעקסט־שטער איז אומבאַקאַנט און דער אָנהייב־בילד איז אומבאַקאַנט

OCR.chat איז פריי צו פּרובירן אָן אַ רעגיסטראַציע. זוכערכײַט PDF לויפט אויף דער שנעלער מדרגה פֿאַר דרוק דאָקומענטן אין איבער 100 שפּראַכן, אַזוי אַ מער־סײַט סקאַנער איז געשווינד באַהאַנדלט און ארײַנגעלייגט ווי אַ סטאַנדאַרד PDF וואָס אַרבעט אין Acrobat, Preview, דיין בלעטערער, און קיין אנדערע װײַזער, מיט אַ גאַנץ־טעקסט־סײַט און אַ קאָפּיר־אַרײַנשטעלן אַרײַנגעבוירן

װי צו סעלעקציע:

1
אַרײַנשטעלן דירעקטאָריעס
קלײַב אױס אַן אױסגעסקאַנער PDF אָדער בילד פֿון אַ זײַט װאָס דו װילסט צו זוכן
2
קלײַב אַלץ אױסselect-action
OCR.chat לייענט אױף יעדע בלעטער און פּאָזיציאָנירט די דערקענטע וואָרטן פּונקט וווּ זיי װײַזן זיך אױף דעם סקאַנער
3
טעקסט פֿאַרבvectors-action
The recognized text is added as an invisible layer over the original image, so the page looks identical but is now searchable.
4
אַרײַנשטעלן דעם PDF
היט אױף אַ סטאַנדאַרד PDF װאָס איר קענט זוכן, סעלעקטירן און קאָפּירן פֿון Acrobat, Preview, אייער בלעטערער אָדער אַ לײענער

קלײַב אַלץ אױס

  • Archive scanned contracts, records, and correspondence so you can find any document by its contents.
  • צוגרייטן געסקאַנענע װײַזן און קײן טעקע פֿאַר לעגאַלע אַנטדעקונג און פֿול־טעקסט איבערזעצונג
  • דיגיטאַליזיר אַ פֿאָרמאַטיר־קעסטל פֿון פּאַפּיר־דאָקументן אין אַ זוכלעך, צוקונפֿט־פֿאַרזיכערטע PDF ביבליאָטעק
  • מאַכן געסקאַנענע ביכער, הענטלעך און רעפֿערענץ־מאַטעריאַלן זוכלעך פֿאַר פֿאַרשײדענע און צייכענונגען
  • Add searchable text to scanned forms and applications so staff can locate entries fast.
  • שאַפֿן אַ זוכערלעך וויסן באַס פֿון סקאַנעד חשבון, אויסגאַבעס, און קבלות פֿאַר אַרײַנפֿירונגען

פֿראַגעס

OCR.chat reads the text on each scanned page and adds it as an invisible layer aligned over the original image. The page looks exactly the same, but the hidden text lets any PDF reader find, select, and copy words from it.

ניטא. דער אָריגינעל געסענט בילד איז ניט פֿאַרשיקט װי דער OCR טעקסט איז ניט אױף דער אויבערשטער זײַט, אַזוי אַז דאָס דאָקומענט זעט אויס אױס װי די אַרײַנגעלאָפֿןע בילדער, װײַל עס איז אױסגעפֿירט װי אַ סעלעקציע

Any standard reader. The output is an ordinary PDF, so search, selection, and copy-paste work in Adobe Acrobat, Apple Preview, your web browser, and other common viewers.

יָה. יעדער זײַט אין PDF איז באַהאַנדלט און דער טעקסט שטער איז צוגעלייגט איבער, אַזוי די זוכן אַרבעט איבער דעם גאנצן דאָקומענט, ניט נאָר איבער דער ערשטער זײַט

The fast tier is well suited to printed scans and produces a reliable text layer for search. Because the text is invisible, an occasional misread does not change how the page looks, and you can review the recognized text side by side before downloading.

The searchable text layer supports over 100 languages, including CJK, Arabic, Cyrillic, and Indic scripts. You can upload scanned PDFs as well as PNG, JPG, and TIFF images, and foreign text is transcribed as written, never translated.

נאָר אַ ביסל. דער אומבאַקאַנטער טעקסט שטער איז קלענער אין פֿאַרבײַטונג מיט די בלעטער בילדער, אַזוי אַ זוכער־פֿאַרבײַטענער PDF איז נאָרמאַלי נאָענט צו דער גרײס פֿון דער אָריגינעל סקענע אין װאָס ער איז ניט געװען אױסגעפֿילט. די זעכלעך בילד דאַטן ווערן אױסגעהאַלטן ווי זיי זײַנען

יָה, אױב אַ פֿלאַך, אױסגעלויכטענע, דירעקטע בילדל איז דער בעסטער צו לייענען. אַ קלאָרע טעלעפֿאָן־פֿאָטאָ פֿון אַ אױסגעדרוקטע זײַט אַרבעט גוט; װײַטער שאָטן, שאָטן, אָדער אַ װײַטער ווינקל קען פֿאַרקלענערן די ריכטיקקײט, אַזוי פֿלאַך די זײַט און װײַז ניט צו שװײַג, װען מע קען

Clean printed scans give the most reliable text layer. Faded, skewed, or noisy pages still get searchable text, but with more chance of a misread. Since the text is invisible, a stray error never changes how the page looks, and you can review the recognized text before downloading.

אײנע טעקע װײַזט זיך שנעל, און מערע טעקע־באַהאַנדלונגען װײַזן זיך אין דער הינטערגרונט. פֿרײַע ניצן אַרײַננעמען אַ חודשלעכע בלעטערער־צובינד; באַצאָלטע װײַזונגען פֿון $5/חודש אַרײַנשטעלן מער בלעטערער (קראָמען רעכענען זיך ווי בלעטערער) און װײַזן אַ סך־פּראָצעסן אַזוי אַז איר קענט אַהין אַהין זוכן אין אַ װײַזונג

י. אַ REST API איז בנימצא אױף באַצאָלטע פּלאָנים, אַזוי אַז איר קענט שיקן געסקאַנענע PDFס און באַקומען זוכן־פֿאַרבינדענע PDFס צוריק פֿון אייער אייגענעם דאָקומענט־אַרבעטס־פֿאָרעם אָן אױפֿצושטעלן יעדער מיט האַנט

איר קענט עס אָפּפּראָװן פֿאַרשײדענעס אָן אַ רעגיסטראַציע, און אַ פֿאַרשײדענעס חשבון אַנטהאַלט אַ מײַנלעך בלעטערער־צובינד, מיט באַצאָלטע פּלענער פֿון $5/מײַן פֿאַר מער בלעטער, באַטש־פּראָסעסינג, און API־צוגאָב. טעקע־נאָמען ווערן באַהאַנדלט נאָר פֿאַר OCR, אויטאָמאַטיש אויסגעלײגט, און קײן מאָל ניט פֿאַרקויף אָדער צעטיילט

ניצן דאָס װײַז־פֿאַרב

Run this tool programmatically with a single POST. Authenticate with the API token from your account page.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=searchable-pdf"

Files of 5 pages or fewer return the result inline; otherwise poll the job, then download it as pdf:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=pdf" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.pdf
לייענען די API דאָקומענטאַציע →
קלײַב אַלץ אױסselect-action

וואָס קען מען פֿאַרבעסערן? דיין אָפּרוף העלפֿט אונדז צו פֿאַרריכטן פּראָבלעמען