PDF a text

Torna a explorar o PDFs digitals en text pla.

📄

Arrossegar i deixar, o enganxar una captura de pantalla

Imatge, PDF, Word (DOCX) o text - llista, navegació, enganxa o usa un URL

🔒 Els vostres fitxers es processen en privat i s' esborraran automàticament.

OCR.chat extraieu text de qualsevol PDF, ja sigui una exportació digital o una pila de pàgines escanejats. Carrega una pàgina PDF multi- pàgina i cada pàgina es processa i combina en un resultat net, còpia- Jack. Les pàgines que ja contenen una capa de text real es llegeixen instantàniament i sense pèrdua, mentre que les pàgines escaneja automàticament es executen a través de ROC, de manera que sempre obtindreu el text més precís que pot oferir el fitxer.

Aquest PDF a convertidor de text es fa per a gent que treballa amb documents llargs: investigadors miners antics documents, programes de seguretat paramatins convertint fitxers de text cercable, i analistes que treia figures d'informes escanejats. Es llegeix més de 100 idiomes, mostra el text extret al costat de la pàgina original per revisar, i mai tradueixen paraules estrangeres, de manera que un PDF multilingüe surti exactament tal com va passar.

No hi ha cap signe necessari provar- ho, i el motor ràpid gestiona els PDFs imprès de forma lliure. Quan un document té taules dens, columnes o escriptura de ma, el motor de la barra d' AAA ofereix una major precisió. Descarrega el resultat com a text pla, Markdown, Word, CSV o JSON, i deixa clar el vostre fitxer és processat per OCR i després esborrat automàticament.

Com fer-ho pdf a text

1
Puja el PDF
Arrossegueu en un únic PDF o navegueu per a ell; els documents multi- pàgina estan totalment implementats.
2
Escolliu el motor i l' idioma
Quedeu-vos amb el motor ràpid per a pàgines impreses, o canvieu al motor de la IA de la barra lateral per a escàners, taules i escriptura a mà; establiu un idioma o auto-detect.
3
Deixa que s' ajusti a les pàgines
Les pàgines amb una capa de text real es llegeixen instantàniament i sense pèrdua; les pàgines escanejades són OCR'd en alta resolució, totes fusionades en un resultat.
4
Revisió i exportació
Marqueu el text contra cada pàgina, després copieu- lo o baixant- lo com TXT, Markdown, DOCX, CSV o JSON.

Ús comuns

  • Investigadors extraient passatges i citacions de revistes escanejats i llibres.
  • Advocadats i para legals convertint fitxers de cas i contractes en text cercable.
  • Els comptes empenten figures i articles de línies de declaracions financeres escanejats.
  • Els arquitectes digitalitzaven els registres històrics i els documents de la impressió per a la preservació.
  • Els treballadors de l'oficina reutilitzant contingut des de antics PDFs sense tornar a publicar pàgines després de la pàgina.
  • Els periodistes busquen documents llargs i tribunals per noms i termes específics.

Preguntes més freqüents

Sí. Cada pàgina es processa i els resultats es reuneixen en una sortida de text continuada que podeu copiar o descarregar.

Les pàgines que contenen una capa de text real s' extrauen instantàniament i sense pèrdua, sense necessitat ROC. Només es poden executar pàgines escanejades a través del ROC, que mantenen una qualitat alta i ràpida.

Podeu provar- ho per a la lliure, amb mesurador de pàgines per pàgina on equival a pàgines de crèdits. Un compte lliure afegeix un cub de pàgina mensual i en els plans pagats de 5/ mesos afegiu més pàgines i processament per lots per a documents grans.

Més de 100, incloent-hi CJK, àrab, ciríl· lic i scripts indicics. Les paraules externes es transcribeixen com a escrites i mai no es van traduir automàticament.

Sí. Les pàgines es rasteritzen i OCR'd automàticament, el motor de la IA és recomanat per escàners febles, taules o lletres de mà.

El vostre fitxer es processa només per ROC i després s' esborra automàticament. Mai no venem ni compartim els vostres documents.

Sí. POST del PDF api/v1/ ocrr / i rebre el text combinat, opcionalment especifica l' idioma, el motor de cordador i el format de sortida.

Elimina la contrasenya o desbloqueja la informació del dispositiu, primer la puja. Un cop s' obre un fitxer el podem llegir, però no podem evitar l' encriptatge en un document bloquejat.

El motor de la IA és el que entén les columnes i l'ordre de lectura, així que el diari, el diari, i dues disposicions de la columna es van trobar en la seqüència correcta en comptes de tenir les columnes juntes.

El processament per lots està disponible en plans pagats, de manera que podeu posar en cua múltiples PDFs en un sol pas. En el plafó lliure, podeu pujar un document alhora.

Text pla (TXT), Markdown, Word (DOCX), PDF cercable, CSV i JSON. Un PDF cercable manté les imatges originals amb una capa de text oculta, i seleccionable afegit a dalt.

No. La vostra pujada queda sense tocar i el text extret es proporciona com a resultat a part, per tant el fitxer font mai no es modificarà.

Useu això mitjançant l' API

Executa aquesta eina programadamàticament amb un únic POST. Autenticar amb el testimoni API del vostre compte.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=pdf-to-text"

Fitxers de 5 pàgines o menys retorna el resultat en línia; altrament enquesta el treball, i després baixa- lo com a txt:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=txt" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.txt
Llegeix els metges de l' API →
Valora aquesta pàgina
5.0/5 (0)

La teva reacció ens ajuda a solucionar problemes.