PDF consultable

Ajouter un calque de texte sélectionnable aux PDF numérisés.

🔍

Faites glisser et déposez, ou collez une capture d'écran

Image, PDF, Word (DOCX) ou texte - déposez, naviguez, collez ou utilisez une URL

🔒 Vos fichiers sont traités en privé et supprimés automatiquement.

Faites une recherche PDF en ajoutant un calque de texte invisible OCR sur vos pages numérisées. Un document numérisé est vraiment juste une pile d'images, vous ne pouvez donc pas trouver, sélectionner ou copier un seul mot en lui. OCR.chat lit le texte et le pose précisément sur le scanner original, en transformant une image plate en PDF, vous pouvez rechercher et sélectionner dans n'importe quel lecteur.

C'est l'outil d'archivage et de gestion des documents, où la possibilité de trouver un contrat par une clause ou une phrase sur des milliers de pages est le point entier. Il est essentiel pour la découverte légale, la conservation des documents et la numérisation des classeurs, et il garde vos pages à l'aspect exactement comme scanné parce que la couche de texte est invisible et l'image originale est intacte.

OCR.chat est libre d'essayer sans inscription. Le PDF consultable fonctionne au niveau rapide pour les documents imprimés en plus de 100 langues, de sorte qu'un balayage multi-pages est traité rapidement et téléchargé comme un PDF standard qui fonctionne dans Acrobat, Preview, votre navigateur, et tout autre visionneur, avec recherche en texte intégral et copier-coller intégré.

Comment faire pdf consultable

1
Téléchargez votre PDF numérisé
Déposer dans un PDF numérisé ou une image d'une page que vous voulez rendre consultable.
2
Lancer l'OCR
OCR.chat lit chaque page et positionne les mots reconnus exactement où ils apparaissent sur le scan.
3
Obtenez un calque de texte invisible
Le texte reconnu est ajouté comme couche invisible sur l'image originale, de sorte que la page semble identique mais est maintenant consultable.
4
Télécharger le PDF consultable
Enregistrez un PDF standard que vous pouvez rechercher, sélectionner et copier à partir d'Acrobat, Aperçu, votre navigateur ou tout lecteur.

Utilisations courantes

  • Archivez les contrats, les dossiers et la correspondance numérisés afin de trouver n'importe quel document par son contenu.
  • Préparer des pièces numérisées et des dossiers de cas pour la découverte juridique et l'examen du texte intégral.
  • Numériser un classeur de documents papier dans une bibliothèque PDF à recherche et à l'épreuve du futur.
  • Faire des livres, des manuels et des documents de référence numérisés une recherche et une citation.
  • Ajouter du texte consultable aux formulaires et applications numérisés afin que le personnel puisse localiser les entrées rapidement.
  • Créer une base de connaissances consultable à partir de factures, relevés et reçus numérisés pour les vérifications.

Foire aux questions

OCR.chat lit le texte de chaque page numérisée et l'ajoute comme un calque invisible aligné sur l'image originale. La page ressemble exactement à la même, mais le texte caché permet à tout lecteur de PDF de trouver, de sélectionner et de copier des mots.

Non. L'image originale scannée est conservée intacte et le texte de l'OCR est invisiblement en haut, de sorte que le document semble identique à ce que vous avez téléchargé tout en devenant pleinement consultable.

Tout lecteur standard. La sortie est un PDF ordinaire, donc la recherche, la sélection et le collage de copie fonctionnent dans Adobe Acrobat, Apple Preview, votre navigateur Web et d'autres téléspectateurs communs.

Oui. Chaque page du PDF est traitée et la couche de texte est ajoutée dans tout le document, donc la recherche fonctionne sur l'ensemble du document, et non pas seulement sur la première page.

Le niveau rapide est bien adapté aux scans imprimés et produit une couche de texte fiable pour la recherche. Parce que le texte est invisible, une lecture erronée occasionnelle ne change pas comment la page ressemble, et vous pouvez revoir le texte reconnu côte à côte avant de télécharger.

La couche de texte consultable prend en charge plus de 100 langues, y compris les scripts CJK, Arabic, Cyrillic et Indic. Vous pouvez télécharger des PDF numérisés ainsi que des images PNG, JPG et TIFF, et le texte étranger est transcrit comme écrit, jamais traduit.

Seulement légèrement. La couche de texte invisible est légère par rapport aux images de la page, de sorte qu'un PDF consultable est généralement proche de la taille originale plutôt que de ballonner.

Oui, bien qu'une capture plate, uniformément éclairée, droite lit mieux. Une photo de téléphone clair d'une page imprimée fonctionne bien; ombres lourdes, éblouissement, ou un angle raide peut diminuer la précision, si aplatir la page et éviter de fausser où vous pouvez.

Les scans imprimés propres donnent la couche de texte la plus fiable. Les pages fadées, biaisées ou bruyantes obtiennent toujours du texte consultable, mais avec plus de chances de mal lire. Comme le texte est invisible, une erreur errante ne change jamais la façon dont la page ressemble, et vous pouvez revoir le texte reconnu avant de télécharger.

Les fichiers uniques fonctionnent rapidement, et les tâches plus longues ou multi-fichier sont traitées en arrière-plan. L'utilisation gratuite comprend une allocation mensuelle de page; les plans payés à partir de 5 $/mois ajoutent plus de pages (les crédits comptent comme pages) et de traitement par lots afin que vous puissiez faire une recherche complète d'archives à la fois.

Oui. Une API REST est disponible sur les plans payants, vous pouvez donc envoyer des PDF numérisés et recevoir des PDF consultables à partir de votre propre flux de travail de document sans télécharger chacun à la main.

Vous pouvez l'essayer gratuitement sans inscription, et un compte gratuit comprend une allocation de page mensuelle, avec des plans payés de 5 $/mois pour plus de pages, le traitement par lots et l'accès aux API. Les fichiers sont traités pour le ROC seulement, supprimés automatiquement, et jamais vendus ou partagés.

Utilisez ceci via l'API

Exécutez cet outil programmatiquement avec un seul POST. Authentifiez-vous avec le jeton API de votre page de compte.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=searchable-pdf"

Les fichiers de 5 pages ou moins renvoient le résultat en ligne; sinon, sondagez le travail, puis téléchargez-le comme pdf:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=pdf" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.pdf
Lire les documents de l'API →
Évaluer cette page
5.0/5 (0)

Que pourrions-nous améliorer? Vos commentaires nous aident à résoudre les problèmes.