PDF procurable

Engade unha capa de texto seleccionábel aos PDF escaneados.

🔍

Arrastre e solte ou apegue unha captura de pantalla

Imaxe, PDF, Word (DOCX) ou texto - soltar, examinar, apegar ou usar un URL

🔒 Os seus ficheiros procesáronse de forma privada e elimináronse automaticamente.

Faga que un PDF sexa procurable engadindo unha capa de texto OCR invisible sobre as páxinas escaneadas. Un documento escaneado é realmente só unha pila de imaxes, polo que non pode atopar, seleccionar ou copiar unha soa palabra nel. OCR.chat le o texto e colocao precisamente sobre a escaneada orixinal, convertendo unha imaxe plana nun PDF que pode procurar e seleccionar en calquera lector.

Esta é a ferramenta para arquivar e xestionar documentos, onde poder atopar un contrato por unha cláusula ou unha frase en miles de páxinas é o punto principal. É esencial para a detección legal, a retención de rexistros e a dixitalización de arquivos, e mantén as páxinas exactamente como foron escaneadas porque a capa de texto é invisíbel e a imaxe orixinal non se toca.

OCR.chat é un programa de proba gratuíto sen rexistro. O PDF procurable funciona no nivel rápido para documentos impresos en máis de 100 linguas, polo que unha digitalización de varias páxinas procesábase rapidamente e descargábase como un PDF estándar que funcionaba en Acrobat, Preview, no navegador e en calquera outro visor, con procura de texto completo e copia e pega integrados.

Como pdf procurable

1
Envíe o seu PDF escaneado
Solte un PDF dixitalizado ou unha imaxe dunha páxina que queira facer procurable.
2
Executar o OCR
OCR.chat le cada páxina e coloca as palabras recoñecidas exactamente onde aparecen na exploración.
3
Obter unha capa de texto invisíbel
O texto recoñecido engádese como unha capa invisible sobre a imaxe orixinal, de xeito que a páxina se ve idéntica pero agora é posíbel procurala.
4
Obter o PDF procurable
Gardar un PDF estándar que pode procurar, escoller e copiar en Acrobat, Preview, o navegador ou calquera lector.

Usos comúns

  • Arquive contratos, rexistros e correspondencia escaneados para que poida atopar calquera documento polo seu contido.
  • Prepare as probas escaneadas e os arquivos de casos para a descuberta legal e a revisión de texto completo.
  • Dixitilice un arquivo de documentos en papel nunha biblioteca PDF buscable e a proba de futuro.
  • Faga que os libros, manuais e material de referencia escaneados sexan buscables para investigación e citas.
  • Engada texto pescudábel aos formularios e aplicacións escaneados para que o persoal poida localizar as entradas rapidamente.
  • Construa unha base de coñecementos pesquisábel a partir de facturas, estados de conta e recibos escaneados para auditorías.

Preguntas frecuentes

OCR.chat le o texto de cada páxina dixitalizada e engádeo como unha capa invisible aliñada sobre a imaxe orixinal. A páxina ten exactamente o mesmo aspecto, pero o texto agochado permite que calquera lector de PDF atope, seleccione e copie as palabras dela.

Non. A imaxe orixinal escaneada presérvase intacta e o texto OCR está invisíbel enriba, polo que o documento parece idéntico ao que enviou e pode ser buscado.

Calquera lector estándar. A saída é un PDF ordinario, polo que as procuras, seleccións e copias e apegados funcionan en Adobe Acrobat, Apple Preview, o navegador web e outros visores comúns.

Si. Procesaranse todas as páxinas do PDF e engadirase a capa de texto por todas elas, de xeito que a procura funcione en todo o documento, non só na primeira páxina.

O nivel rápido é adecuado para dixitalizacións impresas e produce unha capa de texto fiable para procurar. Como o texto é invisíbel, unha lectura errónea ocasional non altera o aspecto da páxina, e pode revisar o texto recoñecido lado a lado antes de obtelo.

A capa de texto pesquisábel soporta máis de 100 linguas, incluíndo os alfabetos CJK, árabe, cirílico e indio. Pode enviar PDF escaneados así como imaxes PNG, JPG e TIFF, e os textos estranxeiros transcríbense como están escritos, nunca traducidos.

Só un pouco. A capa de texto invisíbel é lixeira en comparación coas imaxes da páxina, polo que un PDF procurable é normalmente do tamaño da digitalización orixinal en lugar de ter un tamaño excesivo. Os datos da imaxe visíbel mantense como están.

Si, aínda que unha captura plana, uniformemente iluminada e recta é a mellor. Unha foto clara dunha páxina impresa con teléfono funciona ben; as sombras pesadas, o brillo ou un ángulo agudo poden diminuír a precisión, polo que aplanar a páxina e evitar a inclinación sempre que sexa posíbel.

As dixitalizacións limpas imprimidas dan a capa de texto máis fiable. As páxinas descoloridas, torcidas ou ruidosas aínda obteñen texto pescudábel, pero con máis posibilidades de ser mal lidas. Como o texto é invisíbel, un erro erróneo nunca cambiaparencia da páxina, e pode revisar o texto recoñecido antes de obtelo.

Os ficheiros individuais executan rapidamente e os traballos máis longos ou con varios ficheiros procesan en segundo plano. O uso gratuíto inclúe unha asignación mensual de páxinas; os plans de pago desde $5/ mes engadirán máis páxinas (os créditos contan como páxinas) e procesamento por lotes para que poida facer que todo un arquivo sexa buscable de unha vez.

Si. Nos plans de pago está dispoñíbel unha API REST, polo que pode enviar PDF dixitalizados e recibir PDF procurables do seu propio fluxo de traballo de documentos sen ter que enviar cada un á man.

Pode probalo de balde sen rexistrarse, e unha conta gratuíta inclúe unha cantidade mensual de páxinas, con plans de pago desde $5/ mes para máis páxinas, procesamento por lotes e acceso á API. Os ficheiros procesanse só para OCR, elimínanse automaticamente e nunca se venden nin comparten.

Empregar isto a través da API

Executar esta ferramenta mediante programación cun único POST. Autenticar co token API da páxina da conta.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=searchable-pdf"

Os ficheiros de 5 páxinas ou menos devolven o resultado en liña; doutro xeito, consulta a tarefa e obtén a tarefa como pdf:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=pdf" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.pdf
Ler a documentación da API →
Cualificar esta páxina
5.0/5 (0)

Que podemos mellorar? Os seus comentarios axúdannos a corrixir os problemas.