PDF у тэкст

Пераўтварэньне сканаваных ці лічбавых PDF у звычайны тэкст.

📄

Перацягвайце і адкідвайце, альбо ўстаўце скрыншот

Відарыс, PDF, Word (DOCX) ці тэкст - перацягнуць, прагляд, устаўка, альбо выкарыстаць URL

🔒 Вашы файлы апрацоўваюцца прыватна і выдаляюцца аўтаматычна.

OCR.chat выводзіць тэкст з любога PDF, незалежна ад таго, ці гэта лічбавы экспарт, ці сканаваная стэка старонак. Загрузіце шматстаронкавы PDF, і кожная старонка будзе апрацоўвацца і аб' яднаная ў адзін чысты, гатовы да капіявання вынік. Старонкі, якія ўжо ўтрымліваюць рэальны тэкст, чытаюцца імгненна і без страт, а сканаваныя старонкі аўтаматычна праходзяць праз OCR, так што вы заўсёды атрымліваеце найбольш дакладны тэкст, які можа прапанаваць файл.

Гэты канвэртар PDF у тэкст створаны для людзей, якія працуюць з доўгімі дакументамі: даследчыкі, якія шукаюць старыя дакументы, юрысты, якія пераўтвараюць дакументы ў тэксты з магчымасцю пошуку, і аналітыкі, якія выцягваюць лічбы з сканаваных справаздач. Ён чытае больш за 100 моў, паказвае выцягнуты тэкст побач з арыгінальнай старонкай для прагляду і ніколі не перакладае чужыя словы, таму шматмоўны PDF выходзіць у той жа выглядзе, у якім ён быў унесены.

Для яго выкарыстання не патрабуецца рэгістрацыя, і хуткі рухавік бесплатна апрацоўвае стандартныя друкаваныя PDF- файлы. Калі дакумент мае шчыльныя табліцы, слупкі або рукапіс, рухавік AI Premium забяспечвае большую дакладнасць. Загрузіце вынік як звычайны тэкст, Markdown, Word, CSV або JSON, і будзьце ўпэўненыя, што ваш файл будзе апрацоўвацца для OCR і потым выдалены аўтаматычна.

Як pdf у тэкст

1
Загрузіць PDF
Перацягвайце адзін PDF або праглядайце яго; шматстаронкавыя дакументы поўнасцю падтрымліваюцца.
2
Выбар рухавіка і мовы
Вы можаце застацца з бясплатным хуткім рухавіком для друкаваных старонак, або перайсці на прэміум AI рухавік для сканавання, табліц і рукапісу; вызначыць мову або аўтаматычнае выяўленне.
3
Дазволіць сартаваць старонкі
Усе тэксты, якія змяшчаюцца ў кнізе, напісаны ў тэкстах, якія былі напісаны ў перыяд, калі кнігі былі напісаны, і ўсе яны з'яўляюцца тэкстам, які быў напісаны ў перыяд, калі кнігі былі напісаны.
4
Прагляд і экспартны
Праверце тэкст на кожнай старонцы, а затым скапіруйце яго або загрузіце ў фармаце TXT, Markdown, DOCX, CSV або JSON.

Звычайныя выкарыстанні

  • У перыяд праўлення Сірыуса існавалі кнігі і часопісы, якія друкаваліся ў перыядычных выданнях.
  • Усе дакументы і дакументальныя матэрыялы, якія датычацца дзейнасці і дзейнасці арганізацыі, захоўваюцца ў архіве.
  • Усе лічбы і лічбы-адзнакі ў тэксце вызначаюцца лічбамі.
  • Архіўныя дакументы і дакументы, якія не з'яўляюцца архіўнымі, з'яўляюцца дакументамі, якія не з'яўляюцца архіўнымі.
  • Працадаўцы офісаў, якія перапрацоўваюць змест са старых PDF-файлаў без перапісвання старонак.
  • У перыяд праўлення П. І. Чарняўскага адбыліся значныя змены ў дзяржаўным і грамадскім жыцці.

Частыя пытанні

Так. Кожная старонка апрацоўваецца, і вынікі аб' ядноўваюцца ў адзін тэкставы файл, які можна капіяваць або загружаць.

Старонкі, якія ўтрымліваюць рэальны тэкставы пласт, выцягваюцца імгненна і без страт, без неабходнасці OCR. Толькі сканаваныя старонкі праходзяць праз OCR, што захоўвае якасць і хуткасць.

Вы можаце паспрабаваць яго бясплатна, з памерам на старонку, дзе крэдыты роўныя старонкам. Бясплатны рахунак дадае штомесячны кубак старонак, і плацежныя планы ад $ 5 / месяц дадаюць больш старонак і пакетную апрацоўку для вялікіх дакументаў.

Больш за 100, уключаючы CJK, арабскую, кірыліцу і індыйскую пісьмовыя знакі. Іншыя словы транскрыптуюцца як напісаныя і ніколі не перакладаюцца аўтаматычна.

Так. Сканаваныя старонкі растэрызуюцца і OCR аўтаматычна; для сканавання невялікіх аб' ёмаў, табліц або рукапісу рэкамендуецца выкарыстаць рухавік AI premium.

Ваш файл будзе апрацоўвацца толькі для OCR і затым аўтаматычна выдалены. Мы ніколі не прадаем і не падзяляемся вашымі дакументамі.

Так. POST ваш PDF у /api/v1/ocr/ і атрымаць аб' яднаны тэкст, па жаданні вызначаючы мову, ўзровень рухавіка і фармат вываду.

Выдаліць пароль або разблакаваць PDF на прыладзе, а затым загрузіць яго. Калі файл адкрыты, мы можам яго прачытаць, але не можам аб' ехаць шыфраванне на заблакаваным дакуменце.

У перыяд праўлення Цяньлуна ў Кітаі пачалі з'яўляцца газеты, часопісы, часопісы для дзяцей і іншыя выданні, якія не мелі ніякага дачынення да рэлігіі.

Пакетная апрацоўка даступная ў платных планах, таму вы можаце загружаць некалькі PDF- файлаў за адзін раз. У бясплатным плане вы загружаеце адзін дакумент за раз.

Просты тэкст (TXT), Markdown, Word (DOCX), PDF з магчымасцю пошуку, CSV і JSON. PDF з магчымасцю пошуку захоўвае арыгінальныя малюнкі старонак з схаваным, вылучаным тэкставым пластом, дададзеным зверху.

Не. Ваша загружаная інфармацыя застаецца некранутай, а выдзелены тэкст перадаецца ў асобным выніку, таму зыходны файл не змяняецца.

Выкарыстоўваць праз API

Выканаць гэтую праграму з дапамогай POST. Аўтарызаваць з дапамогай API- тэксту з старонкі вашага рахунку.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=pdf-to-text"

Файл 5 старонак або менш вяртае вынік у радку; у адваротным выпадку праверыць заданне, а затым загрузіць яго як txt:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=txt" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.txt
Прачытаць дакументацыю API →
Ацэнка гэтай старонкі
5.0/5 (0)

Што мы можам палепшыць? Ваша ацэнка дапаможа нам выправіць праблемы.