Sekitar OCR.chat
OCR.chat mengubah mana-mana imej atau PDF ke dalam teks, jadual, dan matematik yang bersih, boleh disunting - dalam lebih 100 bahasa.
OCR masih belum diselesaikan. Kebanyakan alat merosakkan jadual, membuang nombor, tersumbat pada tulisan tangan, atau secara senyap menerjemah perkataan asing. Kami bina OCR.chat untuk betulkan itu: enjin pantas untuk dokumen harian, dan enjin AI premium untuk yang sukar, dengan teks yang dikenali dipaparkan di sebelah asal anda supaya anda boleh percaya apa yang anda salin.
Tiada pendaftaran untuk mencuba, had percuma yang jujur, setiap format eksport pada satu skrin, dan API mudah untuk pembangun.
Dibina pada sumber terbuka terbaik
Kami tidak menyembunyikan apa yang memberi kuasa kepada OCR.chat. Kami pilih model OCR sumber terbuka yang paling kuat, jalankan mereka pada pelayan kami sendiri, dan bina lapisan yang menjadikannya berguna: laluan bahasa, ulasan sisi-selari, setiap format eksport, dan berbual dengan dokumen anda.
-
PaddleOCR (PP-OCRv6) Apache-2.0
Enjin di belakang lapisan pantas percuma kami. Cemerlang pada dokumen cetak dalam 100+ bahasa, dengan model per-bahasa untuk skrip Latin, CJK, Arab, Cyrillic dan India. -
PaddleOCR-VL & DeepSeek-OCR sumber terbuka
Model bahasa visi terbuka di belakang AI Premium, untuk tulisan tangan, matematik dan susunatur kompleks. Kami menghoskannya sendiri pada GPU kami sendiri, jadi dokumen anda kekal pada infrastruktur kami. -
PyMuPDF sumber terbuka
Baca lapisan teks PDF digital dengan serta-merta dan tanpa kehilangan, jadi PDF bersih tidak pernah memerlukan OCR sama sekali, dan mengekspresikan halaman diimbas untuk enjin OCR. -
python-docx & openpyxl sumber terbuka
Baca dokumen Word secara langsung (tiada OCR diperlukan) dan tulis lembaran kerja Excel sebenar untuk alat ekstrak jadual.
Berdiri pada sumber terbuka bermakna anda mendapat ketepatan yang paling canggih yang terus bertambah baik dengan komuniti, bukan kotak hitam. Terima kasih kepada semua orang yang membina projek ini.