PDF에서 텍스트로
스캔된 PDF 또는 디지털 PDF를 일반 텍스트로 변환합니다.
스크린샷 드래그 앤 드롭 또는 붙여넣기
이미지, PDF, Word (DOCX) 또는 텍스트 - 드롭, 검색, 붙여넣기 또는 URL 사용
🔒 파일은 비공개로 처리되고 자동으로 삭제됩니다.
OCR.chat은 디지털 내보내기 또는 스캔된 페이지의 스택이든 PDF에서 텍스트를 추출합니다. 다중 페이지 PDF를 업로드하면 모든 페이지가 처리되어 복사 준비가 된 깨끗한 결과로 결합됩니다. 실제 텍스트 레이어가 이미 포함된 페이지는 손실 없이 즉시 읽히고 스캔된 페이지는 자동으로 OCR을 실행하여 항상 파일에서 제공할 수 있는 가장 정확한 텍스트를 얻을 수 있습니다.
이 PDF 텍스트 변환기는 긴 문서를 작업하는 사람들을 위해 만들어졌습니다. 연구자들은 오래된 논문을 채굴하고, 변호사들은 사건 파일을 검색 가능한 텍스트로 변환하고, 분석가들은 스캔된 보고서에서 수치를 끌어냅니다. 100개 이상의 언어를 읽고, 검토를 위해 원본 페이지 옆에 추출 된 텍스트를 표시하고, 외국어를 번역하지 않으므로 다국어 PDF는 입력한 대로 정확하게 나옵니다.
테스트를 위해 가입할 필요가 없으며, 빠른 엔진은 표준 인쇄 PDF를 무료로 처리합니다. 문서에 밀도 높은 표, 열 또는 손글씨가 있는 경우 프리미엄 AI 엔진이 더 높은 정확도를 제공합니다. 결과를 일반 텍스트, Markdown, Word, CSV 또는 JSON으로 다운로드하면 OCR을 위해 파일이 처리되고 자동으로 삭제됩니다.
어떻게 pdf에서 텍스트로
일반적인 사용
- 연구자들은 스캔된 저널 기사와 책에서 구절과 인용문을 추출합니다.
- 스캔된 사건 파일과 계약을 검색 가능한 텍스트로 변환하는 변호사 및 법률 지원자.
- 회계사 스캔 된 재무 보고서에서 숫자와 라인 항목을 끌어 올립니다.
- 역사 기록과 보존을 위해 인쇄되지 않은 문서를 디지털화하는 파일럿.
- 사무실 직원이 페이지를 다시 입력하지 않고도 이전 PDF의 콘텐츠를 재사용할 수 있습니다.
- 정부 및 법원 PDF를 검색하는 기자들이 특정 이름과 용어를 찾습니다.
자주 묻는 질문
API를 통해 이것을 사용
단일 POST로 프로그래밍 방식으로 이 도구를 실행합니다. 계정 페이지에서 API 토큰으로 인증합니다.
curl -X POST https://ocr.chat/api/v1/ocr/ \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-F "file=@your-file.pdf" \
-F "tool=pdf-to-text"
5페이지 이하의 파일은 인라인 결과를 반환합니다. 그렇지 않으면 작업을 폴링한 다음 다음과 같이 다운로드합니다. txt:
curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=txt" \
-H "Authorization: Bearer YOUR_API_TOKEN" -o result.txt
API 문서 읽기 →