OCR.chat 에 대해

OCR.chat은 모든 이미지나 PDF를 편집 가능한 텍스트, 표, 수학으로 변환합니다.

OCR은 아직 해결되지 않았습니다. 대부분의 도구는 표를 망가뜨리고, 그림을 삭제하고, 필기에 질식하거나, 외국어를 조용히 번역합니다. 우리는 이 문제를 해결하기 위해 OCR.chat을 만들었습니다. 일상 문서를 위한 빠른 엔진과 어려운 문서를 위한 프리미엄 AI 엔진, 인식된 텍스트가 원본 옆에 표시되어 복사한 내용을 신뢰할 수 있습니다.

시도 가입, 솔직한 무료 한계, 한 화면에 모든 내보내기 형식, 개발자를위한 간단한 API.

최고의 오픈 소스에 기반

OCR.chat의 힘은 숨기지 않습니다. 우리는 가장 강력한 오픈 소스 OCR 모델을 선택하고, 자체 서버에서 실행하고, 언어 라우팅, 옆으로 검토, 모든 내보내기 형식, 문서와 채팅 등 유용하게 만드는 레이어를 구축합니다.

  • PaddleOCR (PP-OCRv6) Apache-2.0
    라틴, CJK, 아랍어, 키릴 문자 및 인도 문자에 대한 언어별 모델을 갖춘 100개 이상의 언어로 인쇄된 문서에 탁월한 성능을 제공합니다.
  • PaddleOCR-VL & DeepSeek-OCR 오픈 소스
    필기, 수학, 복잡한 레이아웃을 위한 Premium AI 뒤에 있는 오픈 비전 언어 모델. 저희는 이 모델을 저희의 GPU에 셀프 호스팅하므로 문서가 저희 인프라에 남아 있습니다.
  • PyMuPDF 오픈 소스
    디지털 PDF의 텍스트 레이어를 즉시 손실 없이 읽어서 깨끗한 PDF는 OCR이 전혀 필요하지 않으며 OCR 엔진을 위해 스캔된 페이지를 렌더링합니다.
  • python-docx & openpyxl 오픈 소스
    Word 문서를 직접 읽고(OCR 필요 없음) 테이블 추출 도구를 위해 실제 Excel 스프레드시트를 작성합니다.

오픈 소스를 활용한다는 것은 블랙박스가 아닌 커뮤니티와 함께 계속해서 개선되는 최첨단 정확도를 얻는다는 것을 의미합니다. 이 프로젝트를 구축하는 모든 사람들에게 감사드립니다.

자주 묻는 질문

네, 가입 없이도 OCR 문서를 편리하게 편집할 수 있습니다. 무료 계정을 만들어 월별로 더 많은 페이지를 편집하거나 무제한 페이지, 프리미엄 AI 엔진, API 액세스를 위해 업그레이드하십시오.

PNG, JPG, WEBP, GIF, BMP, TIFF, 다중 페이지 PDF 라틴어, 중국어, 일본어, 한국어, 아랍어, 키릴 문자, 인도 문자를 포함한 100개 이상의 언어로 된 텍스트를 인식합니다.

표는 잘못 정렬된 텍스트가 아닌 실제 Markdown 또는 CSV로 나오고 방정식은 LaTeX로 변환되어 문서에 바로 붙여넣을 수 있습니다.

일반 텍스트, Markdown, Word (DOCX), 검색 가능한 PDF, CSV 및 JSON — 결과 화면에서 모두 클립보드로 복사 한 번의 클릭.

파일은 OCR 용으로만 처리되며 자동으로 삭제됩니다. 저희는 문서를 판매하거나 공유하지 않습니다.

예. 우리의 프리미엄 AI 엔진은 손으로 쓴 노트, 양식, 혼합 인쇄 및 손으로 쓴 페이지를 처리하는 전통적인 OCR보다 훨씬 더 좋습니다. 명확한 손글씨가 가장 잘 작동하며 복사하기 전에 항상 원본과 결과를 비교할 수 있습니다.

네, 다중 페이지 PDF는 페이지별로 처리되며, 이미 텍스트 레이어가 포함된 페이지는 즉시 읽어지고 스캔된 페이지만 OCR을 통해 전송됩니다. 결과 화면에서 기다리는 동안 큰 문서는 백그라운드에서 처리됩니다.

가입하지 않고도 사용할 수 있는 무료 계층이 있습니다. 유료 계획은 월 $5부터 시작하여 더 많은 페이지, 프리미엄 AI 엔진 및 API 액세스를 추가합니다. 사용량은 크레딧으로 측정되며, 크레딧은 페이지 하나와 동일합니다.

대부분의 도구는 테이블을 망가뜨리고, 수치를 떨어뜨리거나, 필기와 수학에 질식시킵니다. OCR.chat은 일상 문서를 위한 빠른 엔진과 어려운 문서를 위한 프리미엄 AI 엔진을 결합하여 테이블과 방정식을 구조화하고, 원본 옆에 텍스트를 표시하고, 한 화면에서 모든 내보내기 형식을 제공합니다.

예. 결과 화면에는 인식된 텍스트가 원본 문서와 함께 나란히 표시되므로 확인하고, 수동으로 수정하고, 만족스러운 결과를 얻은 후에만 복사 또는 내보낼 수 있습니다.

No. OCR.chat은 브라우저에서 완전히 실행됩니다. 이미지 또는 PDF를 업로드하면 텍스트를 다시 얻을 수 있습니다. 다운로드하거나 설치할 필요가 없습니다.

/api/v1/ocr/에 있는 간단한 REST API를 통해 파일을 제출하고 텍스트, Markdown, 테이블, JSON을 페이지별로 분석하여 얻을 수 있습니다. 요청에 따라 빠른 AI 엔진 또는 프리미엄 AI 엔진을 선택할 수 있습니다.

텍스트 읽기 외에도 프리미엄 AI 엔진은 이미지가 보여주는 내용을 일반 언어로 설명하고 접근성과 SEO를 위해 간결한 대체 텍스트를 작성할 수 있습니다. 홈페이지에서 이미지 설명을 켜거나 이미지 설명 및 대체 텍스트 생성 도구를 사용합니다.
이 페이지 평가하기
5.0/5 (0)

개선할 수 있는 점은 무엇입니까? 고객님의 피드백은 문제를 해결하는 데 도움이 됩니다.