PDF থেকে Markdown

RAG এবং LLMs এর জন্য পরিষ্কার Markdown এর জন্য নথি রূপান্তর করুন।

✨ প্রাইম AI ইঞ্জিন
🔒 এটি একটি প্রাইম AI টুল। এটি ব্যবহার করতে একটি বিনামূল্যে অ্যাকাউন্ট তৈরি করুন। বিনামূল্যে নিবন্ধন করুন লগ- ইন
⬇️

স্ক্রিনশট টেনে নিয়ে যান এবং ছেড়ে দিন অথবা পেস্ট করুন

ছবি, PDF, Word (DOCX) অথবা টেক্সট - ড্রপ, ব্রাউজ, পেস্ট অথবা একটি URL ব্যবহার করুন

🔒 আপনার ফাইলগুলি ব্যক্তিগতভাবে প্রক্রিয়াজাত করা হয় এবং স্বয়ংক্রিয়ভাবে মুছে ফেলা হয়।

PDF-কে Markdown-এ রূপান্তর করুন যা আপনার নথির কাঠামো বজায় রাখে, এটিকে একটি দীর্ঘ টেক্সট স্ট্রিং-এ প্লেট করার পরিবর্তে। OCR.chat তার প্রাইম AI ইঞ্জিন ব্যবহার করে প্রতিটি পৃষ্ঠা পড়ে এবং শীর্ষক, বুলেট এবং সংখ্যাযুক্ত তালিকা, টেবিল এবং পাঠের ক্রম পুনঃনির্মাণ করে পরিষ্কার, বিন্যাস-সচেতন Markdown হিসাবে যেখানে Markdown সমর্থিত সেখানে আপনি ব্যবহার করতে পারেন।

এই টুলটি LLM এবং RAG পাইপলাইনে নথি ফিড করার জন্য তৈরি করা হয়েছে, যেখানে কাঠামো হচ্ছে মডেলটি আসলে যা যুক্তি দেয়। এটি রিপোর্ট, ম্যানুয়াল, চুক্তি এবং গবেষণাপত্র নোট অ্যাপলিকেশন যেমন Obsidian, Notion, বা একটি স্থির- সাইট repo এ স্থানান্তর করার জন্য ব্যবহারযোগ্য, অথবা স্ক্যান করা হ্যান্ডআউট সম্পাদনযোগ্য Markdown এ পরিণত করার জন্য যা আপনি সেকেন্ডে পরিষ্কার করতে পারেন।

OCR.chat কোন নিবন্ধন ছাড়াই বিনামূল্যে পরীক্ষা করতে পারে, এবং PDF থেকে Markdown প্রাইম AI স্তরে চলছে তাই জটিল বিন্যাস, বহু-কলাম পৃষ্ঠা, এবং অন্তর্ভুক্ত টেবিল পুরোনো বদলে বদলে আসে না। আপনি স্বীকৃত Markdown আপনার মূল পৃষ্ঠার পাশে দেখতে পারেন নিম্ন-বিশ্বাস স্পট ফ্ল্যাগ সঙ্গে, তাই আপনি আপনার মডেল বা আপনার নোট পৌঁছানোর আগে আপনি যা অনুলিপি করতে পারেন তা বিশ্বাস করতে পারেন।

কিভাবে pdf থেকে markdown

1
আপনার নথি আপলোড করুন
PDF অথবা ছবিটিকে পেজ-এ টেনে নিয়ে যান, স্ক্রিনশটটি পেস্ট করুন অথবা আপনার ডিভাইস থেকে একটি ফাইল বেছে নিন।
2
AI ইঞ্জিনকে পড়তে দাও
প্রাইম এআই স্তর প্রত্যেকটি পৃষ্ঠা প্রক্রিয়াজাত করে, শিরোনাম, তালিকা এবং টেবিল সঠিক পাঠের ক্রম অনুসারে সনাক্ত করে।
3
পাশ- পাশ করে পর্যালোচনা করুন
আপনার মূল লেখার পাশে তৈরি করা Markdown পরীক্ষা করুন, নিম্ন- বিশ্বাসযোগ্য লেখার সাথে ফ্ল্যাগ করা যাতে কিছুই অজানা থেকে যায় না।
4
Markdown ডাউনলোড অথবা অনুলিপি করুন
একটি.md ফাইল রপ্তানি করুন অথবা Markdown সরাসরি আপনার RAG পাইপলাইন, repo, অথবা নোট অ্যাপলিকেশনের জন্য ক্লিপবোর্ডে অনুলিপি করুন।

সাধারণ ব্যবহার

  • RAG এবং LLM গ্রহণের জন্য নথি প্রস্তুত করুন, যেখানে শিরোনাম এবং তালিকা মডেলকে গঠন দেয় যা পুনরুদ্ধার করতে এবং সঠিকভাবে যুক্তি দিতে প্রয়োজন।
  • রিপোর্ট, ম্যানুয়াল এবং PDFs নোট অ্যাপলিকেশন যেমন Obsidian বা Notion তাদের outline হারানোর ছাড়া মাইগ্রেট করুন।
  • উদ্ধৃতি, annotation, অথবা পুনঃলিখিত জন্য স্ক্যান করা গবেষণাপত্র এবং নিবন্ধ পরিষ্কার Markdown এ পরিণত করুন।
  • একটি স্থির-সাইট উত্পাদক বা ডকুমেন্ট রিপোর জন্য Markdown এ পণ্য ডকুমেন্ট এবং অভ্যন্তরীণ উইকি রূপান্তর করুন।
  • চুক্তি এবং নীতিমালা থেকে গঠনমূলক টেক্সট এক্সট্র্যাক্ট করুন যাতে আইনী এবং অনুমোদন দল তাদের অনুসন্ধান এবং উদ্ধৃতি করতে পারে।
  • কোর্স উপাদান এবং অধ্যয়ন নোট জন্য সম্পাদনযোগ্য Markdown এ মুদ্রণকৃত হ্যান্ডআউট এবং ওয়ার্কশিট ডিজিটালাইজ করুন।

প্রায়শই জিজ্ঞাসিত প্রশ্ন

প্রাইম AI ইঞ্জিন জটিল বিন্যাস জন্য tuneed এবং সাধারণত পুনরাবৃত্তি headings, তালিকা, টেবিল, এবং পড়া ক্রম বিশ্বাসযোগ্যভাবে। প্রতিটি ফলাফল আপনার মূল এবং low- confidence টেক্সট সঙ্গে পাশে প্রদর্শিত হয় ফ্ল্যাগ করা হয়, তাই আপনি ব্যবহার করার আগে কিছু পরীক্ষা করতে পারেন।

আপনি PDF এবং PNG, JPG, WEBP, GIF, BMP এবং TIFF ছবি আপলোড করতে পারেন। আউটপুট একটি Markdown (.md) ফাইল, এবং আপনি ফলাফল পর্দা থেকে Markdown আপনার ক্লিপবোর্ডে অনুলিপি করতে পারেন।

হ্যাঁ । টেবিলগুলি বাস্তব Markdown টেবিল হিসাবে পুনঃনির্মাণ করা হবে, যেখানে অসঙ্গত টেক্সট চালানোর পরিবর্তে সংযুক্ত কলাম থাকবে এবং পৃষ্ঠা থেকে কিছুই নিঃশব্দে ফেলে দেওয়া হবে না ।

Markdown নথির কাঠামো সংরক্ষণ করে, যেমন শিরোনাম, তালিকা এবং টেবিল, যা LLMs ব্যবহার করে প্রসঙ্গ বুঝতে এবং সঠিক অংশ পুনরুদ্ধার করতে। একটি কাঁচা টেক্সট ডাম্প এই কাঠামো হারিয়ে ফেলে এবং সাধারণত খারাপ উত্তর উৎপাদন করে।

হ্যাঁ। প্রাইম AI স্তরের মাল্টি-কলাম বিন্যাস সনাক্ত করে এবং সঠিক পড়া ক্রম পুনরায় সংযুক্ত করে কলাম লাইন প্রতি লাইন ইন্টারলেভ করার পরিবর্তে।

OCR.chat ১০০ এরও বেশি ভাষার টেক্সট স্বীকার করে, যার মধ্যে ল্যাটিন, চীনা, জাপানি, কোরীয়, আরবি, সিরিলিক এবং ভারতীয় লিপি রয়েছে। বিদেশী শব্দ লেখার মতো অনুবাদ করা হয় এবং কখনো স্বয়ংক্রিয়ভাবে অনুবাদ করা হয় না।

হ্যাঁ । বিভাগ শিরোনাম Markdown শীর্ষক (# এবং ##) হয়ে যায় তাই আপনার নথি তার outline রাখে, এবং monospaced অথবা indented পাসওয়ার্ড কোড ব্লক হিসাবে wrapped হয় । এই কাঠামোটি একটি RAG রিট্র্যাক্টর চুককে শীর্ষক এবং একটি LLM কোড স্নিপেট অক্ষত রাখতে দেয় ।

OCR.chat টেক্সট বিষয়বস্তুকে গুরুত্ব দেয়, তাই সারণী, ছবি এবং আকৃতি Markdown-এ বাইনারি হিসাবে অন্তর্ভুক্ত করা হয় না। আকৃতির মধ্যে যে কোন টেক্সট, যেমন লেবেল বা শিরোনাম, এখনও পড়া হয় এবং পড়া ক্রম অনুসারে স্থাপন করা হয়, যা সাধারণত একটি LLM-এর প্রয়োজন।

ইনলাইন প্রতীক এবং সরল অভিব্যক্তি টেক্সট হিসাবে অনুবাদ করা হয়, এবং প্রাইম AI স্তরের গণিত LaTeX হিসাবে রেন্ডার করতে পারে তাই সমীকরণ একটি LLM একটি ফর্ম একটি পড়া পারে বেঁচে আছে। খুব ঘন অথবা হাত- আঁকা নোটেশন পাশে- পাশে প্রদর্শন সঙ্গে চেক করা উচিত।

Markdown বিন্যাস ঝামেলা এবং একটি কাঁচা PDF ডাম্প পুনরাবৃত্তি করা মুক্ত স্থান হ্রাস করে, তাই আপনি tighter, ভাল- গঠন ইনপুট পাঠান। খুব দীর্ঘ PDFs জন্য আপনি একটি মডেল এর context উইন্ডোর নিচে থাকার জন্য heading দ্বারা ফলাফল Markdown বিভক্ত করতে পারেন।

একক রূপান্তর আপনার ব্রাউজারেই সরাসরি চলবে, এবং বড় বা বহু-ফাইল কাজ পটভূমিতে প্রক্রিয়া করা হবে। বিনামূল্যে ব্যবহারের জন্য মাসিক পৃষ্ঠা অনুদান প্রদান করা হয়; $৫/মাসে থেকে পরিশোধিত পরিকল্পনা আরও পৃষ্ঠা যোগ করে (পৃষ্ঠা হিসাবে ক্রেডিট গণনা), ব্যাচ প্রক্রিয়াকরণ, এবং একটি REST API যাতে আপনি পিডিএফ-কে Markdown-এ রূপান্তর করতে পারেন আপনার নিজের পাইপলাইন থেকে সরাসরি।

আপনি এটি নিবন্ধন ছাড়া বিনামূল্যে পরীক্ষা করতে পারেন। একটি বিনামূল্যে অ্যাকাউন্ট আপনাকে মাসিক পৃষ্ঠা অনুমোদন দেয়, এবং $5/ মাস থেকে পরিশোধ করা পরিকল্পনা আরও পৃষ্ঠা যোগ করুন, ব্যাচ প্রসেসিং, এবং API অ্যাক্সেস। ফাইল শুধুমাত্র OCR জন্য প্রসেস করা হয়, তারপর স্বয়ংক্রিয়ভাবে মুছে ফেলা হয়, এবং কখনও বিক্রি করা হয় না বা শেয়ার করা হয় না।

API-র মাধ্যমে এটি ব্যবহার করুন

এই টুলটি প্রোগ্রামিং করে একক POST-এর মাধ্যমে চালানো হবে। আপনার অ্যাকাউন্ট পৃষ্ঠা থেকে API টোকেন ব্যবহার করে অনুমোদন করা হবে।

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.png" \
  -F "tool=pdf-to-markdown"

৫ পৃষ্ঠা অথবা কম ফাইল ইনলাইন ফলাফল ফিরিয়ে দেবে; অন্যথায় কাজটি পোল করে, তারপর ডাউনলোড করো md:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=md" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.md
API ডকুমেন্টেশন পড়া হবে →
এই পাতাটি রেটিং দিন
5.0/5 (0)

আমরা কি উন্নতি করতে পারি? আপনার ফিডব্যাক আমাদের সমস্যা সমাধানে সাহায্য করে।