PDF에서 텍스트로

스캔된 PDF 또는 디지털 PDF를 일반 텍스트로 변환합니다.

📄

스크린샷 드래그 앤 드롭 또는 붙여넣기

이미지, PDF, Word (DOCX) 또는 텍스트 - 드롭, 검색, 붙여넣기 또는 URL 사용

🔒 파일은 비공개로 처리되고 자동으로 삭제됩니다.

OCR.chat은 디지털 내보내기 또는 스캔된 페이지의 스택이든 PDF에서 텍스트를 추출합니다. 다중 페이지 PDF를 업로드하면 모든 페이지가 처리되어 복사 준비가 된 깨끗한 결과로 결합됩니다. 실제 텍스트 레이어가 이미 포함된 페이지는 손실 없이 즉시 읽히고 스캔된 페이지는 자동으로 OCR을 실행하여 항상 파일에서 제공할 수 있는 가장 정확한 텍스트를 얻을 수 있습니다.

이 PDF 텍스트 변환기는 긴 문서를 작업하는 사람들을 위해 만들어졌습니다. 연구자들은 오래된 논문을 채굴하고, 변호사들은 사건 파일을 검색 가능한 텍스트로 변환하고, 분석가들은 스캔된 보고서에서 수치를 끌어냅니다. 100개 이상의 언어를 읽고, 검토를 위해 원본 페이지 옆에 추출 된 텍스트를 표시하고, 외국어를 번역하지 않으므로 다국어 PDF는 입력한 대로 정확하게 나옵니다.

테스트를 위해 가입할 필요가 없으며, 빠른 엔진은 표준 인쇄 PDF를 무료로 처리합니다. 문서에 밀도 높은 표, 열 또는 손글씨가 있는 경우 프리미엄 AI 엔진이 더 높은 정확도를 제공합니다. 결과를 일반 텍스트, Markdown, Word, CSV 또는 JSON으로 다운로드하면 OCR을 위해 파일이 처리되고 자동으로 삭제됩니다.

어떻게 pdf에서 텍스트로

1
PDF를 업로드하세요
단일 PDF를 드래그하거나 찾아보세요. 다중 페이지 문서가 완벽하게 지원됩니다.
2
엔진 및 언어 선택
인쇄된 페이지에 대해 무료 빠른 엔진을 유지하거나 스캔, 표, 필기에 대한 프리미엄 AI 엔진으로 전환; 언어를 설정하거나 자동 감지.
3
페이지 정렬을 허용합니다
실제 텍스트 레이어가 있는 페이지는 즉시 손실 없이 읽어집니다. 스캔된 페이지는 고해상도로 OCR되며 모든 결과가 하나로 병합됩니다.
4
검토 및 내보내기
각 페이지의 텍스트를 확인한 다음 복사하거나 TXT, Markdown, DOCX, CSV 또는 JSON으로 다운로드하십시오.

일반적인 사용

  • 연구자들은 스캔된 저널 기사와 책에서 구절과 인용문을 추출합니다.
  • 스캔된 사건 파일과 계약을 검색 가능한 텍스트로 변환하는 변호사 및 법률 지원자.
  • 회계사 스캔 된 재무 보고서에서 숫자와 라인 항목을 끌어 올립니다.
  • 역사 기록과 보존을 위해 인쇄되지 않은 문서를 디지털화하는 파일럿.
  • 사무실 직원이 페이지를 다시 입력하지 않고도 이전 PDF의 콘텐츠를 재사용할 수 있습니다.
  • 정부 및 법원 PDF를 검색하는 기자들이 특정 이름과 용어를 찾습니다.

자주 묻는 질문

모든 페이지가 처리되고 결과가 복사하거나 다운로드할 수 있는 하나의 연속 텍스트 출력으로 결합됩니다.

실제 텍스트 레이어를 포함하는 페이지는 OCR이 필요 없이 즉시 손실 없이 추출됩니다. 스캔된 페이지만 OCR을 통해 실행되므로 품질이 높고 속도가 빠릅니다.

무료 계정은 월별 페이지 버킷을 추가하고, $5/월부터 유료 계획은 더 많은 페이지를 추가하고 대용량 문서에 대한 일괄 처리를 제공합니다.

CJK, 아랍어, 키릴 문자, 인도 문자를 포함한 100개 이상의 문자. 외국어 단어는 쓰여진 대로 번역되며 자동 번역되지 않습니다.

스캔된 페이지는 자동으로 래스터화되고 OCR이 수행됩니다. 희미한 스캔, 표 또는 필기에 대해서는 프리미엄 AI 엔진을 권장합니다.

파일은 OCR 용으로만 처리되고 자동으로 삭제됩니다. 저희는 문서를 판매하거나 공유하지 않습니다.

PDF를 /api/v1/ocr/로 POST하여 언어, 엔진 계층, 출력 형식을 선택적으로 지정하여 결합된 텍스트를 받습니다.

암호를 제거하거나 장치에서 PDF를 잠금 해제한 다음 업로드하십시오. 파일이 열리면 읽을 수 있지만 잠긴 문서의 암호화를 우회할 수는 없습니다.

프리미엄 AI 엔진은 열과 읽기 순서를 이해하므로 신문, 저널 및 두 열 레이아웃은 열을 함께 실행하는 대신 올바른 순서로 나타납니다.

유료 플랜에서는 일괄 처리 기능을 사용할 수 있으므로 한 번에 여러 PDF를 큐에 넣을 수 있습니다. 무료 플랜에서는 한 번에 하나의 문서만 업로드합니다.

일반 텍스트(TXT), Markdown, Word(DOCX), 검색 가능 PDF, CSV, JSON. 검색 가능 PDF는 원본 페이지 이미지를 보유하고 숨겨진 선택 가능한 텍스트 레이어가 위에 추가됩니다.

업로드된 파일은 손상되지 않고 추출된 텍스트는 별도의 결과로 전달되므로 소스 파일은 수정되지 않습니다.

API를 통해 이것을 사용

단일 POST로 프로그래밍 방식으로 이 도구를 실행합니다. 계정 페이지에서 API 토큰으로 인증합니다.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=pdf-to-text"

5페이지 이하의 파일은 인라인 결과를 반환합니다. 그렇지 않으면 작업을 폴링한 다음 다음과 같이 다운로드합니다. txt:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=txt" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.txt
API 문서 읽기 →
이 페이지 평가하기
5.0/5 (0)

개선할 수 있는 점은 무엇입니까? 고객님의 피드백은 문제를 해결하는 데 도움이 됩니다.