PDF לטקסט

הפעל נסרק או PDFs דיגיטלי לטקסט רגיל.

📄

גרור ושחרר, או להדביק צילום מסך

תמונה, PDF, Word (DOCX) או טקסט - ירידה, גלישה, הדבקה או שימוש בכתובת

🔒 הקבצים שלך מעובדים באופן פרטי וממחקים אוטומטית.

:OCR.chat מחלץ טקסט מכל PDF, בין אם הוא יצוא דיגיטלי או ערימת דפים שנסרקו. העלה PDF רב עמודי וכל עמוד מעובד ומורכב לתוצאה אחת נקייה ומוכנה להעתק. דפים שכבר מכילים שכבה אמיתית נקראו באופן מיידי וללא הפסד, בעוד דפים נסרקים עוברים דרך OCR באופן אוטומטי, כך שאתה תמיד מקבל את הטקסט המדויק ביותר שהקובץ יכול להציע.

ממיר PDF זה מיועד לאנשים שעובדים עם מסמכים ארוכים: חוקרים כריית מסמכים ישנים, עוזרים משפטיים הופכים קבצי מקרה לטקסט שניתן לחפש, ואנליסטים מושכים דמויות מתוך דיווחים נסרקים. הוא קורא יותר מ ־ 100 שפות, מראה את הטקסט המופק ליד הדף המקורי לבדיקה, ולעולם לא מתרגם מילים זרות בלחש, כך ש- PDF רב לשוני יוצא בדיוק כפי שהוא נכנס.

אין צורך בחתימה כדי לנסות זאת, והמנוע המהיר מטפל בדפיברילטור סטנדרטיים בחינם. כאשר מסמך יש שולחנות צפופים, עמודים או כתב יד, מנוע הפרמיה AI מספק דיוק גבוה יותר. הורד את התוצאה כטקסט רגיל, Markdown, Word, CSV, או JSON, ושמור על בטוח שהקובץ שלך מעובד עבור OCR ולאחר מכן נמחק אוטומטית.

איך pdf לטקסט

1
העלה את PDF
גרור ב PDF יחיד או לעיין בו; מסמכים רב עמודים נתמכים באופן מלא.
2
בחר את המנוע והשפה
השאר עם מנוע מהיר חינם עבור דפים מודפסים, או לעבור למנוע AI הפרמיה לסריקות, שולחנות וכתב יד; קבע שפה או אוטומטי- detect.
3
תן לזה למיין את הדפים
דפים עם שכבה אמיתית נקראים באופן מיידי וללא הפסד; דפים שנסרקו נמצאים ברזולוציה גבוהה, כולם מתמזגים לתוצאה אחת.
4
חזרה ויצוא
בדוק את הטקסט מול כל עמוד, ואז להעתיק אותו או להוריד כTXT, Markdown, DOCX, CSV, או JSON.

שימושים נפוצים

  • חוקרים מוציאים קטעים וציטוטים מתוך מאמרים וספרים שנסרקו בכתב העת.
  • עורכי דין ועוזרים משפטיים המרת תיקי סרק וחוזים לטקסט שניתן לחפש.
  • רואי חשבון מושכים דמויות ופריטים קו מתוך הצהרות פיננסיות נסרקו.
  • ארכיונאים שמוציאים דיגיטליזציה של רישומים היסטוריים ומסמכי שימור שלא מודפסים.
  • עובדי משרד משתמשים שוב בתוכן של PDFs הישן מבלי לחזור על הדף אחרי הדף.
  • עיתונאים מחפשים אחר ממשלה ובתי משפט ארוכים של פ"ד-אף עבור שמות ותנאים ספציפיים.

שאלות לעתים קרובות

כן, כל דף מעובד והתוצאות משולבות לפלט טקסט אחד מתמשך שאפשר להעתיק או להוריד.

דפים המכילים שכבת טקסט אמיתית מופקים באופן מיידי וללא צורך ב-OCR. דפים שנסרקו רק עוברים דרך OCR, ששומרים על איכות גבוהה ומהירות מהירה.

אתה יכול לנסות את זה בחינם, עם כל דף שבוחן איפה אשראי שווה דפים חשבון חופשי מוסיף דלי דפים חודשי, ותוכניות בתשלום מ 5/חודש להוסיף יותר דפים ועיבוד אצווה למסמכים גדולים.

מעל 100, כולל CJK, ערבית, קירילית ותסריטים אינדיים.

דפים סורקים הם מצונזרים וOCR'd באופן אוטומטי; מנוע AI הפרמיה מומלץ לסריקות קלושות, שולחנות או כתב יד.

הקובץ שלך מעובד רק עבור OCR ולאחר מכן נמחק אוטומטית.

PDF/PST שלך ל /api/v1/ocr/ ולקבל את הטקסט המשולב, אופציונלי לציין שפה, מנוע ופורמט פלט.

הסר את הסיסמה או פתח את PDF על המכשיר שלך ראשון, לאחר מכן להעלות אותו. ברגע שקובץ פתוח אנחנו יכולים לקרוא אותו, אבל אנחנו לא יכולים לעקוף הצפנה על מסמך נעול.

מנוע ה-AI הפרמיה מבין טורים וסדר קריאה, כך שעיתון, יומן, וסידורים דו-קולוניים יוצאים ברצף הנכון במקום שהעמודים ירוצו יחד.

עיבוד Batch זמין על תוכניות בתשלום, כך שאתה יכול לעמוד בתור PDFs מרובים בבת אחת. על השכבות החופשיות אתה מעלה מסמך אחד בכל פעם.

PDF, CSV, ו-JSON. PDF ניתן לחיפוש שומר את תמונות הדף המקוריות עם שכבה מוסתרת, ניתן לבחור אותה למעלה.

לא, לא נגעו בהעלאה שלך והטקסט שהופק נשלח כתוצאה נפרדת,

השתמש בזה באמצעות API

הפעל כלי זה בתכנות עם POST יחיד. אימות עם האסימון API מדף החשבון שלך.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=pdf-to-text"

קבצים של 5 עמודים או פחות חוזרים על השורה של התוצאה; אחרת תסקור את העבודה, ואז תוריד אותה בתור txt:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=txt" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.txt
קרא את מסמכי API →
דרג את העמוד הזה
5.0/5 (0)

המשוב שלך עוזר לנו לפתור בעיות.