حوالي OCR.chat
OCR.chat يحول أي صورة أو PDF إلى نص نظيف قابل للتحرير، الجداول، والرياضيات - في أكثر من 100 لغة.
لا تزال عملية التعرف البصري على النصوص غير محسومة. فمعظم الأدوات تقوم بتمزيق الجداول، أو إسقاط الأرقام، أو الخنق بالخط، أو ترجمة الكلمات الأجنبية في صمت. وقد بنينا OCR.chat لإصلاح هذا: محرك سريع للوثائق اليومية، ومحرك ذكي عالي الجودة للوثائق الصعبة، مع النص المعرف الذي يظهر بجانب النص الأصلي، حتى تتمكن من الثقة بما تنسخه.
لا تسجيل لمحاولة، حدود حرة صادقة، كل شكل التصدير على شاشة واحدة، و API بسيطة للمطورين.
بنيت على أفضل المصدر المفتوح
نحن لا نخفي ما يحرك OCR.chat. نحن نختار أقوى نماذج التعرف البصري على النصوص المفتوحة المصدر، ونشغلها على خوادمنا الخاصة، ونبني الطبقات التي تجعلها مفيدة: توجيه اللغة، مراجعة جانب بجانب، كل صيغة تصدير، والدردشة مع وثيقتك.
-
PaddleOCR (PP-OCRv6) Apache-2.0
المحرك وراء طبقتنا السريعة المجانية. ممتاز على الوثائق المطبوعة في أكثر من 100 لغة، مع نماذج لكل لغة للكتب اللاتينية، CJK، العربية، السيريلية والهندية. -
PaddleOCR-VL & DeepSeek-OCR المصدر المفتوح
لقد وجدنا أننا قادرون على إنشاء نماذج لغة الرؤية المفتوحة وراء الذكاء الاصطناعي الأعلى جودة، للكتابة بالخط، والرياضيات، والتخطيط المعقد. ونحن نستضيفها على وحدتنا المركزية الرسومية الخاصة بنا، لذا فإن وثائقك تظل على بنية تحتية لدينا. -
PyMuPDF المصدر المفتوح
يقرأ الطبقة النصية لملفات PDF الرقمية فورا وبدون فقدان، وبالتالي لا تحتاج ملفات PDF النظيفة إلى التعرف البصري على النصوص على الإطلاق، ويعرض الصفحات المسحوبة لآلات التعرف البصري على النصوص. -
python-docx & openpyxl المصدر المفتوح
وقراءة وثائق Word مباشرة (لا حاجة إلى التعرف البصري على الحروف) وكتابة جداول بيانات Excel حقيقية لأدوات استخراج الجداول.
الوقوف على المصدر المفتوح يعني أنك تحصل على أحدث دقة التي تستمر في التحسن مع المجتمع، وليس صندوق أسود. شكراً لكل من يبني هذه المشاريع.