PDF کان Markdown

RAG ۽ LLMs لاءِ صاف Markdown لاءِ دستاويز تبديل ڪريو.

✨ AI انجن
🔒 ھيءُ پرائمري AI اوزار آھي. ان کي استعمال ڪرڻ لاءِ مفت اڪائونٽ ٺاهيو. مفت ۾ رجسٽر ٿيو داخلا
⬇️

اسڪرين شاٽ کي ڌڪيو ۽ ڇڏيو يا چٽيو

تصوير، PDF، لفظ (DOCX) يا متن - ڇڏڻ، براؤز ڪرڻ، لڳائڻ يا URL استعمال ڪرڻ

🔒 توھان جون فائلون ذاتي طور تي پروسيس ڪيون وينديون آھن ۽ پاڻمرادو حذف ڪيون وينديون آھن.

PDF کي Markdown ۾ تبديل ڪريو جيڪو توهان جي دستاويز جي ٺاھ کي محفوظ رکي ٿو ان جي بدران ان کي هڪ ڊگهي متن جي تار ۾ فليٽ ڪرڻ. OCR.chat هر صفحي کي پنهنجي پرائم AI انجنيئر سان پڙهي ٿو ۽ عنوانن، بوٽ ۽ نمبر ٿيل لسٽون، ٽيبل ۽ پڙهڻ جي ترتيب کي صاف، ترتيب-آگاه Markdown وانگر استعمال ڪري سگهو ٿا جتي Markdown حمايت ڪئي وئي آهي.

هي اوزار ڪنهن به شخص لاء LLMs ۽ RAG پائپ لائنن ۾ دستاويز کي فوڊ ڪرڻ لاء ٺاهيو ويو آهي، جتي ٺاھڻ آهي ته ماڊل حقيقت ۾ سوچي ٿو. اهو رپورٽون، دستاويز، معاهدا ۽ تحقيقي ورقن کي نوٽس ايپليڪيشنن وانگر Obsidian، Notion، يا هڪ اسٽيٽ-سائيٽ ريپو ۾ منتقل ڪرڻ لاء فائديمند آهي، يا هڪ اسڪين ٿيل دستاويز کي تبديل ڪرڻ لاء تبديل ٿيل Markdown ۾ تبديل ڪري سگهو ٿا توهان سيڪنڊن ۾ صاف ڪري سگهو ٿا.

OCR.chat مفت آهي ڪو به رجسٽريشن سان آزمائش ڪرڻ لاء، ۽ PDF کي Markdown پرائمري AI سطح تي هلندو آهي ته جيئن پيچيده ترتيبون، ڪيترن ئي-سٽون صفحا، ۽ ضم ٿيل ٽيبلن کي غير محفوظ طور تي اچي ٿو. توهان پنهنجي اصل صفحي جي ويجهو سڃاتل Markdown کي ڏسي سگهو ٿا گهٽ اعتماد جا نشان نشان لڳل، تنهنڪري توهان پنهنجي ماڊل يا نوٽس کي پهچڻ کان اڳ ڪاپي ڪرڻ کان اڳ توهان تي اعتماد ڪري سگهو ٿا.

ڪيئن pdf کان markdown

1
پنھنجو دڪان اپ لوڊ ڪريو
PDF يا تصوير صفحي تي ڌڪي ۽ ڇڏ، اسڪرين شاٽ لکو، يا پنهنجي ڊيوائسز مان فائل چونڊيو.
2
AI انجن کي پڙهڻ ڏيو
پريميئم اي آءِ طبقو هر صفحي کي پروسيس ڪري ٿو، عنوانن، لسٽن ۽ ٽيبلن کي صحيح پڙهڻ جي ترتيب سان گڏ ڳولي ٿو.
3
پاسي پاسي جو جائزو وٺو
پيدا ڪيل مارڪ ڊائون کي اصل سان گڏ چڪاس ڪريو، گهٽ اعتماد واري متن سان فليگ ڪريو ته جيئن ڪابه شيءِ ناقابل نظر نه ٿي وڃي.
4
ڊائون لوڊ يا ڪاپي ڪريو
.md فائل برآمد ڪريو يا Markdown کي ڪٽنب جي ڪٽنب ۾ سڌو ڪاپي ڪريو پنھنجي RAG پائپ لائن، ريپو، يا نوٽ ايپليڪيشن لاءِ.

عام استعمال

  • RAG ۽ LLM جي ڦوڪڻ لاء دستاويز تيار ڪريو، جتي عنوان ۽ قائمة ماڊل کي ٺاھڻ جي ضرورت آهي ۽ صحيح طور تي سوچڻ جي ضرورت آهي.
  • رپورٽون، دستاويز ۽ پي ڊي ايفز کي نوٽس ايپليڪيشنن ۾ منتقل ڪريو جيئن ته Obsidian يا Notion انهن جي شڪل وڃائڻ کانسواءِ.
  • اسڪين ڪيل تحقيقي دستاويز ۽ مضمون صاف Markdown ۾ حوالو ڏيڻ، نوٽس يا وري لکڻ لاءِ تبديل ڪريو.
  • پيداوار دوکو ۽ اندروني ويڪيز کي مارڪ ڊائون ۾ تبديل ڪريو هڪ اسٽيٽ-سائيٽ پيدا ڪندڙ يا دوکو ريپو لاء.
  • معاهدن ۽ پاليسين مان ٺهيل متن ڪڍو ته جيئن قانوني ۽ مطابقت واريون ٽيمون ڳولي ۽ انهن کي حوالو ڏئي سگھن.
  • پرنٽ ٿيل دستاويز ۽ ڪم ڪار جي شٽن کي ڊجيٽل طور تي ترتيب ڏيڻ واري مارڪ ڊائون ۾ ڪورس مواد ۽ مطالعي جي نوٽس لاءِ.

گھڻا پڇيل سوال

پرائمري AI انجن پيچيده ترتيبن لاءِ ٺهيل آهي ۽ عام طور تي عنوان، لسٽون، ٽيبل ۽ پڙهڻ جو ترتيب سچائي سان وري پيدا ڪري ٿو. هر نتيجو توهان جي اصل ۽ گهٽ اعتماد واري متن سان گڏ سامهون ڏيکاريل آهي، تنهنڪري توهان ان کي استعمال ڪرڻ کان اڳ ڪنهن به شيء کي تصديق ڪري سگهو ٿا.

PDF ۽ PNG، JPG، WEBP، GIF، BMP ۽ TIFF تصويرون اپ لوڊ ڪري سگهو ٿا. نتيجو Markdown (.md) فائل آهي، ۽ توهان Markdown کي نتيجي جي اسڪرين مان کليپ بورڊ ۾ ڪاپي ڪري سگهو ٿا.

ھائو. ٽيبل حقيقي مارڪ ڊائون ٽيبل وانگر وري ٺاھيا ويندا آھن، جنھن ۾ صحيح سٽون آھن، نه ته غلط ترتيب ڏنل متن جا ھلندڙ، ۽ صفحي مان ڪابه شيءِ خاموشيءَ سان نه وجھبي آھي.

Markdown دڪاني جو ٺاھ رکندو آھي، جھڙوڪ سرن، لسٽن ۽ ٽيبلن، جن کي LLMs استعمال ڪري ٿو ته مضمون سمجھي ۽ صحيح حصن کي حاصل ڪري. هڪ خام متن ڊمپ اهو ٺاھ وڃائيندو آھي ۽ عام طور تي خراب جواب پيدا ڪندو آھي.

ھائو. پريميئم AI طبقو ڪيترن-ڪلونن جا ترتيب ڳوليندو آھي ۽ انھن کي صحيح پڙهڻ جي ترتيب ۾ وري گڏ ڪندو آھي انھيءَ بجاءِ ته ڪلونن کي لائين جي لائين سان گڏ ڪري.

OCR.chat 100 کان وڌيڪ ٻولين ۾ متن سڃاڻندو آھي، جن ۾ لاتين، چيني، جاپاني، ڪورين، عربي، سيريل ۽ هندي لکت شامل آھي. غير ملڪي لفظن کي لکيل طرح ترجمو ڪيو ويندو آھي ۽ ڪڏهن به خودڪار ترجمو نه ڪيو ويندو آھي.

ھائو. حصي جا عنوان مارڪ ڊائون هيڊس (# ۽ ##) ٿيندا آھن تنھنڪري توھان جو دستاويز پنھنجي شڪل کي برقرار رکندو آھي، ۽ مونوسپيسڊ يا انڊيڪس ٿيل پاسا ڪوڊ بلاک وانگر ويڙھيل آھن. اھو ٺاھ جيڪو ھڪ RAG ريٽريوئر ٽڪر کي هيڊس تي ۽ ھڪ LLM ڪوڊ جي ٽڪرن کي برقرار رکڻ جي اجازت ڏئي ٿو.

OCR.chat متن جي مواد تي ڌيان ڏئي ٿو، تنهنڪري چارٽس، فوٽو ۽ تصويرون مارك ڊائون ۾ بائنري طور داخل نه ڪيا ويا آهن. تصوير جي اندر ڪوبه متن، جهڙوڪ ليٽس يا عنوان، اڃا تائين پڙهيو ويو آهي ۽ پڙهڻ جي ترتيب ۾ رکيو ويو آهي، جيڪو عام طور تي LLM جي ضرورت آهي.

لاٽس

Markdown ترتيب جي شور ۽ وري وري واريءَ جاءِ کي ڪڍي ٿو، تنهنڪري توھان گھٽ، بهتر ٺاھيل داخلا موڪلي سگھوٿا. تمام ڊگھن PDFs لاءِ توھان نتيجي ۾ Markdown کي ورهايو سگھوٿا ھيڊنگ سان ماڊل جي ڪنٽرول ويجهو رھي.

هڪڙو تبديلي توهان جي برائوزر ۾ صحيح طور تي هلندي آهي، ۽ وڏي يا ملٽي-فائل ڪمن کي پس منظر ۾ عمل ڪيو ويندو آهي. مفت استعمال مهيني صفحي جي معاوضي سان اچي ٿو؛ $ 5 / مهيني کان ادا ڪيل منصوبا وڌيڪ صفحا شامل ڪريو (صفحن جي حساب سان ڪرائي)، باڪس پروسيسنگ، ۽ REST API ته توهان PDFs کي پنهنجي پائيپ لائن کان مارڪ ڊائون ڏانهن سڌو تبديل ڪري سگهو ٿا.

توهان ان کي ڪنهن به رجسٽريشن سان مفت ۾ آزمائي سگهو ٿا. هڪ مفت اڪائونٽ توهان کي مهيني صفحي جي اجازت ڏئي ٿو، ۽ $ 5 / مهيني کان ادا ڪيل منصوبا وڌيڪ صفحا، باڪس پروسيس ۽ API رسائي شامل ڪريو. فائل صرف OCR لاءِ پروسيس ڪيا ويندا آهن، پوءِ پاڻمرادو حذف ڪيا ويندا آهن، ۽ ڪڏهن به وڪرو نه ڪيا ويندا يا ورهايا ويندا آهن.

API ذريعي استعمال ڪريو

ھي ٽولز پروگرامي طور ھڪ POST سان هلايو. API ٽوڪِن سان توھان جي اڪائونٽ صفحي مان تصديق ڪريو.

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.png" \
  -F "tool=pdf-to-markdown"

5 صفحن يا گهٽ جي فائل نتيجو لاٽ ۾ موٽائي ٿي، ٻي صورت ۾ ڪم کي پوئلڳ ڪريو، پوءِ ان کي اھڙي طرح ڊائون لوڊ ڪريو md:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=md" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.md
API دوکو پڙهو →
ھن صفحي کي تصنيف ڪريو
5.0/5 (0)

ڇا بهتر ڪري سگھون ٿا؟ توھان جو رايو اسان کي مسئلا حل ڪرڻ ۾ مدد ڏيندو.