PDF de búsqueda

Agregue una capa de texto seleccionable a los PDF escaneados.

🔍

Arrastre y suelte, o pegue una captura de pantalla

Imagen, PDF, Word (DOCX) o texto - soltar, navegar, pegar o utilizar una URL

🔒 Sus archivos se procesan de forma privada y se eliminan automáticamente.

Haga que un PDF sea posible de buscar añadiendo una capa de texto OCR invisible sobre sus páginas escaneadas. Un documento escaneado es realmente sólo una pila de imágenes, por lo que no puede encontrar, seleccionar o copiar una sola palabra en él. OCR.chat lee el texto y lo coloca precisamente sobre el escaneo original, convirtiendo una imagen plana en un PDF que puede buscar y seleccionar en cualquier lector.

Esta es la herramienta para archivar y gestionar documentos, donde el punto es poder encontrar un contrato por una cláusula o una frase a través de miles de páginas. Es esencial para el descubrimiento legal, la retención de registros y la digitalización de archivadores, y mantiene sus páginas buscando exactamente como escaneadas porque la capa de texto es invisible y la imagen original no está tocada.

OCR.chat es libre de probar sin registro. El PDF buscable se ejecuta en el nivel rápido para documentos impresos en más de 100 idiomas, por lo que un escaneo de varias páginas se procesa rápidamente y descarga como un PDF estándar que funciona en Acrobat, Vista previa, su navegador, y cualquier otro visor, con búsqueda de texto completo y copiar-pegadura incorporada.

Cómo pdf de búsqueda

1
Cargar su PDF escaneado
Deseche un PDF escaneado o una imagen de una página que desee hacer que sea posible buscar.
2
Ejecutar el OCR
OCR.chat lee cada página y coloca las palabras reconocidas exactamente donde aparecen en el escaneo.
3
Obtener una capa de texto invisible
El texto reconocido se añade como una capa invisible sobre la imagen original, por lo que la página parece idéntica pero ahora es buscable.
4
Descargar el PDF que se puede buscar
Guarde un PDF estándar que puede buscar, seleccionar y copiar en Acrobat, Vista previa, su navegador o cualquier lector.

Usos comunes

  • Archivo de contratos escaneados, registros y correspondencia para que pueda encontrar cualquier documento por su contenido.
  • Preparar las pruebas escaneadas y los archivos de casos para su descubrimiento legal y revisión de texto completo.
  • Digitalizar un archivador de documentos de papel en una biblioteca PDF de búsqueda, a prueba de futuro.
  • Haga libros escaneados, manuales y material de referencia que puedan ser buscados para investigación y citación.
  • Agregue texto de búsqueda a formularios escaneados y aplicaciones para que el personal pueda localizar entradas rápidamente.
  • Cree una base de conocimientos que pueda ser consultada a partir de facturas escaneadas, estados de cuentas y recibos para auditorías.

Preguntas frecuentes

OCR.chat lee el texto en cada página escaneada y lo añade como una capa invisible alineada sobre la imagen original. La página se ve exactamente igual, pero el texto oculto permite que cualquier lector de PDF encuentre, seleccione y copie palabras de ella.

No. La imagen escaneada original se conserva intacta y el texto OCR se encuentra invisiblemente encima, por lo que el documento se ve idéntico a lo que se subió mientras se puede buscar completamente.

Cualquier lector estándar. La salida es un PDF ordinario, así que busca, selecciona y pega copias en Adobe Acrobat, Apple Preview, tu navegador web y otros espectadores comunes.

Sí. Cada página del PDF es procesada y la capa de texto es añadida en todo, así que la búsqueda funciona en todo el documento, no sólo en la primera página.

El nivel rápido es muy adecuado para escanear impresos y produce una capa de texto confiable para la búsqueda. Debido a que el texto es invisible, una lectura errónea ocasional no cambia el aspecto de la página, y puede revisar el texto reconocido lado a lado antes de descargar.

La capa de texto que se puede buscar admite más de 100 idiomas, incluyendo scripts CJK, árabe, cirílico e índico. Puede subir PDF escaneados, así como PNG, JPG y imágenes TIFF, y el texto extranjero se transcribe como escrito, nunca traducido.

La capa de texto invisible es ligera en comparación con las imágenes de la página, por lo que un PDF que se puede buscar suele estar cerca del tamaño del escaneo original en lugar de los globos.

Sí, aunque una captura plana, uniformemente iluminada, recta lee mejor. Una foto de teléfono clara de una página impresa funciona bien; sombras pesadas, resplandor, o un ángulo empinado puede reducir la precisión, por lo que aplanar la página y evitar sesgo donde se puede.

Los escaneos impresos limpios proporcionan la capa de texto más confiable. Las páginas desfiguradas, sesgadas o ruidosas todavía obtienen texto que puede buscarse, pero con más probabilidades de que se lea mal. Como el texto es invisible, un error extraviado nunca cambia el aspecto de la página, y puede revisar el texto reconocido antes de descargarlo.

Los archivos individuales se ejecutan rápidamente, y el proceso de trabajos más largos o multi-ficheros en segundo plano. El uso gratuito incluye una asignación mensual de página; planes pagados desde $5/mo añadir más páginas (créditos cuentan como páginas) y procesamiento por lotes para que pueda hacer una búsqueda de archivo completa a la vez.

Sí. Una API REST está disponible en planes de pago, por lo que puede enviar PDF escaneados y recibir PDFs de su propio flujo de trabajo de documentos sin cargar cada uno a mano.

Puede probarlo gratis sin registro, y una cuenta gratuita incluye un subsidio mensual de página, con planes pagados desde $5/mo para más páginas, procesamiento por lotes y acceso a API. Los archivos se procesan para OCR solamente, se eliminan automáticamente y nunca se venden ni se comparten.

Utilice esto a través de la API

Ejecute esta herramienta programáticamente con un solo mensaje. Autenticar con el token de API desde la página de su cuenta.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=searchable-pdf"

Archivos de 5 páginas o menos devuelven el resultado en línea; de lo contrario, encuestar el trabajo, y luego descargarlo como pdf:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=pdf" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.pdf
Lea los documentos de API →
Calificar esta página
5.0/5 (0)

¿Qué podríamos mejorar? Tus comentarios nos ayudan a solucionar problemas.