Поиск PDF

Добавить отбираемый текстовый слой в отсканированные PDF.

🔍

Перетаскивать и сбрасывать или вставлять скриншот

Фото, PDF, Word (DOCX) или текст - падение, просмотр, вставка или использование URL

🔒 Ваши файлы обрабатываются наедине и удаляются автоматически.

Сделайте поиск PDF возможным путем добавления невидимого текстового слоя OCR на ваших отсканированных страницах. Отсканированный документ — это просто стопка изображений, поэтому вы не можете найти, выбрать или скопировать ни одно слово в нем. OCR.chat читает текст и устанавливает его точно на оригинальном сканировании, превращая плоское изображение в PDF, которое вы можете найти и выбрать в любом читателе.

Это инструмент архивирования и управления документооборотом, где возможность найти контракт с помощью положения или фразы на тысячах страниц является всей сутью. Это необходимо для юридического обнаружения, хранения записей и оцифровки файловых шкафов, и это позволяет вам смотреть на ваши страницы точно так же, как сканировать, потому что текстовый слой невидим и оригинальный образ нетронут.

OCR.chat может попробовать без регистрации. Поиск PDF работает на быстром уровне для печатных документов на более чем 100 языках, поэтому многостраничное сканирование обрабатывается быстро и загружается как стандартный PDF, который работает в Acrobat, Preview, вашем браузере и любом другом зрителье, с полным поиском текста и копировальной пасте.

Как поиск pdf

1
Загрузить сканированный PDF
Запиши сканированный PDF или изображение страницы, которую вы хотите сделать доступной для поиска.
2
Запустить обследование
OCR.chat читает каждую страницу и помещает признанные слова именно там, где они появляются на сканировании.
3
Получите невидимый текстовый слой
Признанный текст добавлен как невидимый слой над оригинальным изображением, поэтому страница выглядит идентичной, но теперь доступна для поиска.
4
Загрузка поискового PDF
Сохранить стандартный PDF, который вы можете найти, выбрать и скопировать из Acrobat, Preview, браузера или любого читателя.

Общие виды применения

  • Архивировать контракты, записи и переписку, чтобы вы могли найти любой документ по его содержанию.
  • Подготовка сканированных вещественных доказательств и досье дел для юридического открытия и полного изучения текста.
  • Перенести шкаф с бумагами в доступную для поиска и надежную для будущего библиотеку НСО.
  • Сделайте отсканированные книги, руководства и справочные материалы доступными для исследований и цитирования.
  • Добавить текст, который можно найти, в сканированные формы и приложения, с тем чтобы сотрудники могли быстро найти записи.
  • Создание базы знаний, поддающихся поиску, на основе отсканированных счетов-фактур, ведомостей и квитанций для проведения ревизий.

Часто задаваемые вопросы

OCR.chat читает текст на каждой отсканированной странице и добавляет его как невидимый слой, привязанный к оригинальному имиджу. Страница выглядит точно так же, но скрытый текст позволяет любому читателю PDF найти, выбрать и копировать слова из него.

Нет. Оригинальное сканированное изображение сохраняется нетронутым, и текст OCR незримо сидит сверху, так что документ выглядит идентично тому, что вы загрузили, и становится полностью поисковым.

Любой стандартный читатель. Выход является обычным PDF, так что поиск, отбор и работа с копировальной пастой в Adobe Acrobat, Apple Preview, ваш веб-браузер и другие общие зрители.

Да, каждая страница в PDF обрабатывается и текстовый слой добавляется по всему тексту, поэтому поиск работает по всему документу, а не только по первой странице.

Быстрый уровень хорошо подходит для печати сканирования и создания надежного текстового слоя для поиска. Поскольку текст невидим, время от времени неправильное чтение не меняет того, как выглядит страница, и вы можете просматривать признанный текст бок о бок перед загрузкой.

Слой поиска поддерживает более 100 языков, включая CJK, арабский, кириллический и индикальный сценарий. Вы можете загружать отсканированные PDF, а также изображения PNG, JPG и TIFF, и иностранный текст передаётся как письменный, так и не переведенный.

Невидимый текстовый слой легковесен по сравнению с страницами, поэтому поисковый PDF обычно ближе к оригинальному сканированию, чем к аэростату. Данные видимого изображения хранятся так, как есть.

Да, хотя плоская, равномерно освещенная, прямая запечатлевшаяся страница лучше всего подходит. Ясная телефонная фотография печатной страницы работает хорошо; тяжелые тени, свет или крутой угол могут снизить точность, так что плоские страницы и избегать скейта там, где вы можете.

Чистая печатная сканировка дает наиболее надежный текстовый слой. Изображаемый, искажаемый или шумный листы все еще получают доступный текст, но с большей вероятностью неправильного чтения. Поскольку текст невидим, ошибка в заблуждении никогда не изменяет того, как выглядит страница, и вы можете пересмотреть признанный текст перед загрузкой.

Одиночные файлы работают быстро и дольше или многофайлово время работы на заднем плане. Бесплатное использование включает ежемесячное пособие на страницу; оплачиваемые планы с 5 долл./мо добавляют больше страниц (кредиты считаются страницами) и обработку пакетов, чтобы можно было одновременно сделать весь архив открытым для поиска.

РУОТА API доступен в оплачиваемых планах, так что вы можете отправить отсканированные PDF и получить доступные для поиска PDF обратно из вашего собственного документооборота без загрузки каждого из них вручную.

Вы можете попробовать бесплатно без регистрации, и бесплатный счет включает ежемесячное пособие на страницу, с оплаченными планами на 5 долл. США за больше страниц, обработку партии и доступ к API. Файлы обрабатываются только для OCR, удаляются автоматически и никогда не продаются или не делятся.

Используйте это через API

Программно прогоните этот инструмент с помощью единого POST.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=searchable-pdf"

Файлы объемом 5 страниц или меньше возвращают результат в линию; в противном случае опрашивают работу, затем загружают его как pdf:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=pdf" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.pdf
Читать документы API →
Строка
5.0/5 (0)

Ваши отзывы помогают нам решать проблемы.