تبدیل PDF به متن

تبدیل اسکن شده یا دیجیتال PDF به متن ساده.

📄

کشیدن و رها کردن یا چسباندن یک تصویر صفحه نمایش

تصویر، پی‌دی‌اف، واژه (DOCX) یا متن - انداختن، مرور، چسباندن یا استفاده از نشانی وب

🔒 پرونده هاتون به صورت خصوصی پردازش ميشه و به طور خودکار حذف ميشه

OCR.chat متن را از هر پی‌دی‌اف استخراج می‌کند ، چه صادرات دیجیتالی باشد و چه پشته صفحات اسکن‌شده. یک پی‌دی‌اف چندصفحه‌ای را بارگذاری کنید و هر صفحه پردازش می‌شود و به یک نتیجه تمیز و آماده برای رونوشت ترکیب می‌شود. صفحاتی که از قبل حاوی لایۀ متن واقعی هستند بلافاصله و بدون از دست دادن خوانده می‌شوند ، در حالی که صفحات اسکن‌شده به طور خودکار از طریق OCR اجرا می‌شوند ، بنابراین همیشه دقیق‌ترین متنی را که پرونده می‌تواند ارائه دهد ، دریافت می‌کنید.

این مبدل پی‌دی‌اف به متن برای افرادی که با اسناد طولانی کار می‌کنند ساخته شده است: محققان که از اسناد قدیمی استخراج می‌کنند، معاونان حقوقی که پرونده‌های پرونده را به متن قابل جستجو تبدیل می‌کنند، و تحلیلگران که اعداد را از گزارش‌های اسکن شده استخراج می‌کنند. این بیش از ۱۰۰ زبان را می‌خواند، متن استخراج شده را در کنار صفحه اصلی برای بررسی نشان می‌دهد، و هرگز کلمات خارجی را به صورت خاموش ترجمه نمی‌کند، بنابراین یک پی‌دی‌اف چندزبانه دقیقاً همان‌طور که وارد شد، بیرون می‌آید.

برای استفاده از این موتور نیازی به ثبت نام نیست و موتور سریع آن پی‌دی‌اف‌های چاپ شده استاندارد را مجانی مدیریت می‌کند. هنگامی که سند جدول‌های متراکم، ستون‌ها یا دست‌نوشته‌ها دارد، موتور هوش مصنوعی برتر دقت بالاتری را ارائه می‌دهد. نتیجه را به صورت متن ساده، Markdown، Word، CSV یا JSON بارگیری کنید و مطمئن باشید که پرونده شما برای OCR پردازش می‌شود و سپس به صورت خودکار حذف می‌شود.

چطور تبدیل pdf به متن

1
بارگذاری PDF خود
یک PDF را بکشید یا به آن بروید؛ اسناد چندصفحه‌ای کاملاً پشتیبانی می‌شوند.
2
انتخاب موتور و زبان
برای صفحات چاپ شده با موتور سریع رایگان بمانید یا به موتور هوش مصنوعی برای اسکن، جدول و دست‌نوشته‌ها تغییر دهید؛ یک زبان یا تشخیص خودکار را تنظیم کنید.
3
بذار صفحات رو مرتب کنه
صفحات با لایه متن واقعی بلافاصله و بدون از دست دادن خوانده می‌شوند؛ صفحات اسکن شده با وضوح بالا OCR می‌شوند، همه آن‌ها در یک نتیجه ادغام می‌شوند.
4
بازنگری و صادرات
متن را در هر صفحه بررسی کنید، سپس آن را کپی کنید یا به صورت TXT، Markdown، DOCX، CSV یا JSON دانلود کنید.

کاربردهای مشترک

  • پژوهشگران، گذرها و نقل قول‌ها را از مقالات مجله و کتاب‌های اسکن شده استخراج می‌کنند.
  • وکلا و معاونان حقوقی که پرونده‌های اسکن شده و قراردادها را به متن قابل جستجو تبدیل می‌کنند.
  • حسابداران که اعداد و ارقام رو از گزارش هاي مالي اسکن شده ميگيرند
  • آرشیوگران، اسناد تاریخی و اسناد چاپ نشده را برای حفظ دیجیتال می‌کنند.
  • کارمندان دفتری که محتوای قدیمی PDF را بدون تایپ دوباره صفحه بعد از صفحه دوباره استفاده می‌کنند.
  • روزنامه‌نگاران به دنبال نام‌ها و اصطلاحات خاص در PDFهای طولانی دولت و دادگاه هستند.

پرسش‌های متداول

بله. هر صفحه پردازش می‌شود و نتایج به یک خروجی متنی پیوسته ترکیب می‌شوند که می‌توانید رونوشت یا بارگیری کنید.

صفحاتی که حاوی لایۀ متن واقعی هستند ، بلافاصله و بدون از دست دادن استخراج می‌شوند ، بدون نیاز به OCR. فقط صفحات اسکن‌شده از طریق OCR اجرا می‌شوند ، که کیفیت بالا و سرعت بالا را حفظ می‌کند.

یک حساب رایگان یک صفحه ماهانه را اضافه می‌کند و برنامه‌های پرداختی از ۵ دلار در ماه صفحات بیشتری را اضافه می‌کنند و پردازش دسته ای برای سندهای بزرگ را فراهم می‌کنند.

بیش از ۱۰۰ ، از جمله CJK ، عربی ، سیریلیک ، و هندی نوشتارها. کلمات خارجی به عنوان نوشته شده رونوشت می‌شوند و هرگز ترجمه خودکار نمی‌شوند.

بله. صفحات اسکن شده به صورت خودکار راستر و OCR می‌شوند؛ موتور AI Premium برای اسکن‌های کم‌رنگ، جدول‌ها یا دست‌نوشته‌ها توصیه می‌شود.

پرونده شما فقط برای OCR پردازش می‌شود و سپس به طور خودکار حذف می‌شود. ما هرگز سندهای شما را نمی‌فروشیم یا به اشتراک نمی‌گذاریم.

بله. پی‌دی‌اف خود را به /api/v1/ocr/ POST کنید و متن ترکیبی را دریافت کنید، که زبان، سطح موتور و قالب خروجی را مشخص می‌کند.

حذف گذرواژه یا قفل‌شکنی پی‌دی‌اف در دستگاه شما، سپس بارگذاری آن. هنگامی که پرونده باز می‌شود، می‌توانیم آن را بخوانیم، اما نمی‌توانیم رمزگذاری را در سند قفل‌شده دور بزنیم.

موتور هوش مصنوعی پریمیوم ستون‌ها و ترتیب خواندن را درک می‌کند، بنابراین روزنامه، مجله و دو ستون در ترتیب درست به جای ستون‌ها با هم اجرا می‌شوند.

پردازش دسته ای در برنامه‌های پرداختی در دسترس است، بنابراین می‌توانید چند پی‌دی‌اف را در یک بار صف کنید. در سطح رایگان، در یک زمان یک سند را بارگذاری می‌کنید.

متن ساده (TXT)، Markdown، Word (DOCX)، PDF جستجوپذیر، CSV، و JSON. یک PDF جستجوپذیر تصاویر صفحه اصلی را با لایه متن مخفی و قابل انتخاب در بالای آن نگه می‌دارد.

نه. بارگذاری شما دست نخورده باقی می‌ماند و متن استخراج شده به عنوان نتیجه جداگانه ارائه می‌شود ، بنابراین پروندۀ منبع هرگز تغییر نمی‌کند.

استفاده از این از طریق API

این ابزار را به صورت برنامه‌ریزی شده با یک POST تک اجرا کنید. با نشان API از صفحه حساب شما هویت‌یابی کنید.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=pdf-to-text"

پرونده‌های ۵ صفحه یا کمتر ، نتیجه را در خط برمی‌گردانند. در غیر این صورت ، کار را پرس و جو کنید ، سپس آن را به عنوان بارگیری کنید txt:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=txt" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.txt
خواندن مستندات API →
رتبه این صفحه
5.0/5 (0)

چه چيزي رو مي تونيم بهتر کنيم؟ بازخورد شما به ما کمک مي کنه مشکلات رو حل کنيم