PDF a texto

Converta PDF dixitais ou escaneados en texto simple.

📄

Arrastre e solte ou apegue unha captura de pantalla

Imaxe, PDF, Word (DOCX) ou texto - soltar, examinar, apegar ou usar un URL

🔒 Os seus ficheiros procesáronse de forma privada e elimináronse automaticamente.

OCR.chat extrae texto de calquera PDF, xa sexa unha exportación dixital ou unha pila de páxinas escaneadas. Envíe un PDF de varias páxinas e cada páxina será procesada e combinada nun resultado limpo e listo para copiar. As páxinas que xa conteñan unha capa de texto real léense instantaneamente e sen perdas, mentres que as páxinas escaneadas son executadas mediante OCR automaticamente, de xeito que sempre obterá o texto máis preciso que o ficheiro poida ofrecer.

Este conversor de PDF a texto está feito para persoas que traballan con documentos longos: investigadores que extraen documentos antigos, asistentes xurídicos que converten arquivos de casos en texto pesquisábel e analistas que extraen cifras de informes escaneados. Le máis de 100 linguas, mostra o texto extraído xunto á páxina orixinal para a revisión e nunca traduce silenciosamente palabras estranxeiras, polo que un PDF multilingüe sae exactamente como entrou.

Non é preciso rexistrarse para probalo, e o motor rápido xestiona PDFs impresos estándar de balde. Cando un documento ten táboas densas, columnas ou escrita a man, o motor AI premium proporciona maior precisión. Baixe o resultado como texto simple, Markdown, Word, CSV ou JSON, e asegúrese de que o seu ficheiro é procesado para OCR e logo borrado automaticamente.

Como pdf a texto

1
Envíe o seu PDF
Arrastre un PDF ou navegue ata el; os documentos multipáxina están totalmente soportados.
2
Escolla o motor e a lingua
Manter o motor rápido e gratuíto para as páxinas impresas, ou cambiar ao motor de IA premium para escanear, táboas e escrita a man; escoller unha lingua ou detectar automaticamente.
3
Deixar que ordene as páxinas
As páxinas cunha capa de texto real léense instantaneamente e sen perdas; as páxinas escaneadas son OCR a alta resolución, todas fundidas nun só resultado.
4
Revisar e exportar
Comprobe o texto en cada páxina, e logo cópieo ou transfíraa como TXT, Markdown, DOCX, CSV ou JSON.

Usos comúns

  • Investigadores extraendo pasaxes e citas de artigos de revistas e libros escaneados.
  • Avogados e paralegais convertendo arquivos de casos e contratos escaneados en texto buscable.
  • Contadores extraendo cifras e elementos de liña dos estados financeiros escaneados.
  • Arquivos dixitalizados de documentos históricos e documentos sen imprimir para preservación.
  • Os empregados de oficina reutilizan o contido de PDFs antigos sen ter que volver escribir páxina tras páxina.
  • Xornalistas buscando longos PDFs do goberno e dos tribunais por nomes e termos específicos.

Preguntas frecuentes

Si. Procesa cada páxina e os resultados combínanse nunha saída de texto continua que pode copiar ou obter.

As páxinas que conteñan unha capa de texto real son extraídas instantaneamente e sen perdas, sen necesidade de OCR. Só as páxinas dixitalizadas son executadas mediante OCR, o que mantén a calidade alta e a velocidade alta.

Pode probalo de balde, cunha medición por páxina onde os créditos son iguais ás páxinas. Unha conta gratuíta engade un cubo de páxinas mensual, e os plans de pago desde $5/ mes engan máis páxinas e procesamento por lotes para documentos grandes.

Máis de 100, incluíndo os alfabetos CJK, árabe, cirílico e indio. As palabras estranxeiras transcríbense como están escritas e nunca se traducen automaticamente.

Si. As páxinas dixitalizadas son rasterizadas e OCR automaticamente; recoméndase o motor AI premium para dixitalizacións, táboas ou escrita a man.

O seu ficheiro só se procesa para OCR e logo bórrase automaticamente. Nunca vendemos nin compartimos os seus documentos.

Si. POST o PDF a / api/ v1/ ocr / e reciba o texto combinado, especificando opcionalmente a lingua, o nivel do motor e o formato de saída.

Elimine o contrasinal ou desbloquee o PDF no seu dispositivo primeiro e despois envíeo. Unha vez que un ficheiro estea aberto podemos lelo, pero non podemos ignorar o cifrado nun documento bloqueado.

O motor de IA premium entende as columnas e a orde de lectura, polo que os deseños de xornal, diario e dúas columnas saen na secuencia correcta no canto de ter as columnas executándose xuntas.

O procesamento por lotes está dispoñíbel nos plans de pago, polo que pode poñer en fila varios PDFs de unha soa vez. No nivel gratuíto envía un documento á vez.

Texto simple (TXT), Markdown, Word (DOCX), PDF procurable, CSV e JSON. Un PDF procurable mantén as imaxes da páxina orixinal cunha capa de texto escondida e seleccionábel engadida enriba.

Non. O envío queda intacto e o texto extraído é entregado como resultado separado, polo que o ficheiro de orixe nunca se modifica.

Empregar isto a través da API

Executar esta ferramenta mediante programación cun único POST. Autenticar co token API da páxina da conta.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=pdf-to-text"

Os ficheiros de 5 páxinas ou menos devolven o resultado en liña; doutro xeito, consulta a tarefa e obtén a tarefa como txt:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=txt" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.txt
Ler a documentación da API →
Cualificar esta páxina
5.0/5 (0)

Que podemos mellorar? Os seus comentarios axúdannos a corrixir os problemas.