PDF à la loupe

Convertir les documents en Markdown propre pour RAG et LLMs.

✨ Moteur IA Premium
🔒 C'est un outil IA Premium. Créez un compte gratuit pour l'utiliser. Inscrivez-vous gratuitement Connexion
⬇️

Faites glisser et déposez, ou collez une capture d'écran

Image, PDF, Word (DOCX) ou texte - déposez, naviguez, collez ou utilisez une URL

🔒 Vos fichiers sont traités en privé et supprimés automatiquement.

Convertissez le PDF en Markdown qui maintient la structure de votre document au lieu de l'aplatir en une longue chaîne de texte. OCR.chat lit chaque page avec son moteur AI premium et reconstruise les en-têtes, les listes de puces et numérotées, les tables et l'ordre de lecture comme propre, mise en page-connaissant Markdown vous pouvez utiliser n'importe où Markdown est supporté.

Cet outil est conçu pour tous ceux qui alimentent les documents en pipelines LLM et RAG, où la structure est ce que le modèle raisonne réellement. Il est tout aussi utile pour déplacer des rapports, manuels, contrats et documents de recherche dans des applications de note comme Obsidian, Notion, ou un site statique repo, ou pour transformer un document scanné en Markdown modifiable vous pouvez nettoyer en quelques secondes.

OCR.chat est libre d'essayer sans inscription, et PDF à Markdown fonctionne sur le niveau AI premium si complexes mises en page, pages multicolonnes, et des tables intégrées viennent à travers intact plutôt que brouillé. Vous voyez le Markdown reconnu à côté de votre page originale avec des spots de faible confiance marqués, afin que vous pouvez faire confiance à ce que vous copiez avant qu'il n'atteigne jamais votre modèle ou vos notes.

Comment faire pdf à la loupe

1
Téléchargez votre document
Faites glisser et déposez un PDF ou une image sur la page, collez une capture d'écran ou choisissez un fichier dans votre appareil.
2
Laissez le moteur AI lire
Le niveau IA de qualité supérieure traite chaque page, en détectant les en-têtes, les listes et les tableaux ainsi que l'ordre de lecture correct.
3
Examen côte à côte
Vérifiez le Markdown généré à côté de votre original, avec un texte de faible confiance marqué de sorte que rien ne glisse par inaperçu.
4
Télécharger ou copier le Markdown
Exportez un fichier.md ou copiez le Markdown directement dans votre presse-papiers pour votre pipeline, repo ou application de note RAG.

Utilisations courantes

  • Préparer des documents pour l'ingestion de RAG et de LLM, où les rubriques et les listes donnent au modèle la structure dont il a besoin pour récupérer et raisonner avec précision.
  • Migrer les rapports, les manuels et les PDF en notes d'applications comme Obsidian ou Notion sans perdre leur contour.
  • Transformez les documents de recherche et les articles scannés en Markdown propre pour citation, annotation ou réécriture.
  • Convertir les documents produits et les wikis internes en Markdown pour un générateur de site statique ou un repo docs.
  • Extraire du texte structuré des contrats et des politiques afin que les équipes juridiques et de conformité puissent les rechercher et les citer.
  • Numériser les documents imprimés et les feuilles de travail en Markdown modifiable pour les documents de cours et les notes d'étude.

Foire aux questions

Le moteur IA de qualité supérieure est adapté aux mises en page complexes et reproduit fidèlement les titres, les listes, les tableaux et l'ordre de lecture. Chaque résultat est affiché côte à côte avec votre texte original et peu fiable, de sorte que vous pouvez vérifier n'importe quoi avant de l'utiliser.

Vous pouvez télécharger des images PDF ainsi que des images PNG, JPG, WEBP, GIF, BMP et TIFF. La sortie est un fichier Markdown (.md) et vous pouvez également copier le Markdown dans votre presse-papiers depuis l'écran de résultat.

Oui. Les tableaux sont reconstruits comme de véritables tables Markdown avec des colonnes alignées plutôt que des séries de texte mal alignées, et rien n'est silencieusement supprimé de la page.

Markdown conserve la structure du document, comme les titres, les listes et les tables, que les LLM utilisent pour comprendre le contexte et récupérer les passages corrects. Un dump de texte brut perd cette structure et produit généralement des réponses pires.

Oui. Le niveau IA de qualité supérieure détecte les mises en page multicolonnes et les réassemble dans l'ordre de lecture correct au lieu d'interlaisser les colonnes ligne par ligne.

OCR.chat reconnaît le texte dans plus de 100 langues, y compris le latin, le chinois, le japonais, le coréen, l'arabe, le cyrillique et les scripts Indic.

Oui. Les titres de section deviennent des en-têtes de Markdown (# et ##) de sorte que votre document conserve son contour, et les passages monoespaces ou en-dentés sont enveloppés comme des blocs de code. Cette structure permet à un morceau RAG de récupérer sur les en-têtes et à un LLM de garder les extraits de code intacts.

OCR.chat se concentre sur le contenu du texte, de sorte que les graphiques, les photos et les figures ne sont pas intégrés comme binaires dans le Markdown. Tout texte à l'intérieur d'une figure, comme les étiquettes ou les légendes, est toujours lu et placé dans l'ordre de lecture, ce qui est généralement ce dont a besoin un LLM.

Les symboles en ligne et les expressions simples sont transcrits en texte, et le niveau IA de qualité supérieure peut rendre les maths comme LaTeX pour que les équations survivent sous une forme que LLM peut lire.

Markdown réduit le bruit de mise en page et l'espace blanc répété d'une décharge PDF brute, vous envoyez donc une entrée plus serrée et mieux structurée. Pour les très longs PDF, vous pouvez diviser le Markdown résultant en vous dirigeant vers le reste sous la fenêtre contextuelle d'un modèle.

Les conversions uniques sont effectuées dans votre navigateur et les tâches plus grandes ou multi-fichier sont traitées en arrière-plan. L'utilisation gratuite est offerte avec une allocation mensuelle de page; les plans payés à partir de 5 $/mois ajoutent plus de pages (compte des crédits en pages), le traitement par lots et une API REST afin que vous puissiez convertir les PDF en Markdown directement depuis votre propre pipeline.

Vous pouvez l'essayer gratuitement sans inscription. Un compte gratuit vous donne une allocation de page mensuelle, et les plans payés à partir de 5 $/mois ajouter plus de pages, le traitement par lots, et l'accès API. Les fichiers sont traités pour l'OCR seulement, puis supprimés automatiquement, et jamais vendu ou partagé.

Utilisez ceci via l'API

Exécutez cet outil programmatiquement avec un seul POST. Authentifiez-vous avec le jeton API de votre page de compte.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.png" \
  -F "tool=pdf-to-markdown"

Les fichiers de 5 pages ou moins renvoient le résultat en ligne; sinon, sondagez le travail, puis téléchargez-le comme md:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=md" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.md
Lire les documents de l'API →
Évaluer cette page
5.0/5 (0)

Que pourrions-nous améliorer? Vos commentaires nous aident à résoudre les problèmes.