PDF-ից տեքստի

Սկանավորված կամ թվային PDF-ները վերածել պարզ տեքստի։

📄

Տեղադրել կամ տեղադրել էկրանագրությունը

նկար, PDF, Word (DOCX) կամ տեքստը - նետել, այցելել, փակցնել կամ օգտագործել URL

🔒 Ձեր ֆայլերը կպատրաստվեն մասնավորապես և ավտոմատ կերպով կջնջվեն։

OCR.chat-ը դուրս է բերում տեքստ ցանկացած PDF-ից, լինի դա թվային արտահանում կամ սկանավորված էջերի կուտակ։ Բեռնեք բազմէջ PDF և յուրաքանչյուր էջ կվերլուծվի և կհամադրվի մեկ մաքուր, կպցնելու համար պատրաստ արդյունքի մեջ։ Այն էջերը, որոնք արդեն պարունակում են իրական տեքստի շերտ, կարդացվեն անմիջապես և առանց կորուստների, իսկ սկանավորված էջերը կկատարվեն OCR-ի միջոցով, այնպես որ դուք միշտ կստանաք ամենադժվարին տեքստը՝ այն, ինչ կարող է տալ ֆայլը։

Այս PDF- ի տեքստի վերածողը նախատեսված է երկար փաստաթղթերի հետ աշխատող մարդկանց համար. հետազոտողները հին փաստաթղթերը վերամշակում են, իրավաբանները փաստաթղթերը վերածում են որոնման համար հարմար տեքստի, իսկ վերլուծաբանները՝ սկանավորված զեկույցներից թվերը դուրս բերում։ Այն կարդում է ավելի քան 100 լեզու, ցույց է տալիս վերամշակված տեքստը՝ սկզբնական էջից դուրս, և երբեք անձայն չի թարգմանում օտար բառեր, այնպես որ բազմլեզու PDF- ը դուրս է գալիս այնպես, ինչպես որ ներդրվել է։

Չկա գրանցում, որպեսզի փորձեք այն, և արագ գործող համակարգը անվճար է աշխատում ստանդարտ տպագրված PDF-ների հետ։ Երբ փաստաթուղթը պարունակում է խիտ աղյուսակներ, սյունակներ կամ ձեռքի գրառումներ, բարձրորակ AI գործող համակարգը ավելի ճշգրիտ է։ Բեռնեք արդյունքը որպես պարզ տեքստը, Markdown, Word, CSV կամ JSON, և համոզվեք, որ ձեր ֆայլը OCR-ի համար պրոցեսավորվում է, ապա ինքնաբերաբար ջնջվում է։

Ինչպես pdf-ից տեքստի

1
Բեռնել PDF- ը
Տեղադրեք մեկ PDF կամ մուտքագրեք այն։ Բազմաէջյա փաստաթղթերը լիովին աջակցվում են։
2
Ընտրեք սերվերը և լեզուն
Կապվել ազատ արագ գործող համակարգի հետ տպագրված էջերի համար, կամ փոխել premium AI գործող համակարգի հետ սկանավորման, աղյուսակների և ձեռքի գրության համար, ընտրել լեզու կամ ինքնաբերաբար հայտնաբերել։
3
Թույլ տվեք այն դասավորի էջերը
Էջերը իրական տեքստի շերտով արագ և առանց կորստի կարդացվում են։ Սկանավորված էջերը OCR-ի են ենթարկվում բարձր լուսավորությամբ, բոլորը միավորվում են մեկ արդյունքում։
4
Հաշվետվություն և արտահանում
Ստուգեք տեքստը յուրաքանչյուր էջում, ապա կպցրեք կամ ներբեռնեք այն որպես TXT, Markdown, DOCX, CSV կամ JSON։

Համատարած օգտագործում

  • Ընդհանուր դասակարգման սկզբունքները և դասակարգման մեթոդները, տեխնիկական ցուցումներ և գրքեր.
  • Ավտոմատացված տեխնոլոգիաների և ինֆորմատիկայի ոլորտում տեխնոլոգիաների և ինֆորմատիկայի ոլորտում տեխնոլոգիաների զարգացման ոլորտում։
  • Հաշվապահները գումարներ են վերցնում ֆինանսական հաշվետվություններից։
  • 15-րդ դարի սկզբին, որի ժամանակ գրվել են պատմական նյութեր և նկարագրություններ։
  • Կենտրոնական գրասենյակի աշխատակիցները կարող են վերամշակել հին PDF-ների բովանդակությունը՝ առանց էջից էջ վերագրելու։
  • Ֆրանսիական պետական և քաղաքական գործիչ, Ֆրանսիայի ազգային հերոս, Ֆրանսիայի ազգային հերոս (1995)։

Հաճախակի տրվող հարցեր

Այո, յուրաքանչյուր էջը վերամշակվում է և արդյունքները միավորվում են մի ամբողջական տեքստի արտադրանքի մեջ, որը կարող եք պատճենել կամ ներբեռնել։

էջեր, որոնք պարունակում են իրական տեքստի շերտ, դուրս են բերվում անմիջապես և առանց կորստի, առանց OCR- ի անհրաժեշտության։ Միայն սկանված էջերը անցնում են OCR- ի միջոցով, որը պահպանում է որակը և արագությունը։

Դուք կարող եք փորձել այն անվճար, յուրաքանչյուր էջի համար հաշվարկով, որտեղ վարկերը հավասար են էջերին։ Ազատ հաշիվը ավելացնում է ամսական էջերի քանակը, իսկ վճարովի պլանները $5/ ամսից ավելացնում են ավելի շատ էջեր և մեծ փաստաթղթերի համար խումբային աշխատանք։

100-ից ավելի, ներառյալ CJK, արաբերեն, կիրիլինգ և հնդկական գրատախտակներ։ Առևտրային բառերը թարգմանվում են գրվածի նման և երբեք չեն փոխակերպվում ինքնուրույն։

Այո։ Սկանավորված էջերը ռեստերացվում են և OCR- ը ավտոմատ կերպով կատարվում է։ Premium AI- ն խորհուրդ է տրվում սկանավորված էջերի, աղյուսակների կամ ձեռքի գրության համար։

Ձեր ֆայլը կպատրաստվի միայն OCR- ի համար և ապա ավտոմատ կերպով կջնջվի։ Մենք երբեք չենք վաճառի կամ կիսվի ձեր փաստաթղթերով։

Այո։ POST Ձեր PDF-ը /api/v1/ocr/ և ստանալ միավորված տեքստը, ընտրելիորեն նշելով լեզուն, ռեսուրսների մակարդակները և ելքի ձևաչափը։

Ընտրեք Ձեր սարքից PDF-ի փականը կամ փականը բացելուց հետո տեղադրեք այն։ Երբ էջը բացվում է, մենք կարող ենք այն կարդալ, բայց չենք կարող բացառել գրանցումը փակված էջում։

Premium AI-ն հասկանում է սյունակներն ու կարդալու կարգը, այնպես որ թերթերը, ամսագրերը և երկու սյունակների դասավորությունները դուրս են գալիս ճիշտ հաջորդականությամբ, փոխարենը սյունակները միասին աշխատելու համար։

Բեթային աշխատանքը հասանելի է վճարովի պլանների դեպքում, այնպես որ դուք կարող եք միաժամանակ մի քանի PDF-եր դասավորել հերթականությամբ։ Ազատ պլանի դեպքում դուք կարող եք միաժամանակ մի քանի փաստաթղթեր ներբեռնել։

Պարզ տեքստը (TXT), Markdown, Word (DOCX), որոնման PDF, CSV և JSON. որոնման PDF-ը պահում է սկզբնական էջերի պատկերները, որոնման տեքստը ավելացվում է վերևում թաքնված, ընտրելի տեքստի շերտով։

Ոչ։ Ձեր վերբեռնումը չի փոխվում, իսկ վերցված տեքստը ներկայացվում է որպես առանձին արդյունք, այսպիսով աղբյուրի ֆայլը երբեք չի փոխվում։

Օգտագործել այս API- ի միջոցով

Աշխատեցրեք այս գործիքը ծրագրային կերպով մեկ POST-ով։ Ավտոմատացրեք API token-ով Ձեր հաշվի էջից։

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=pdf-to-text"

5 էջ կամ ավելի քիչ չափսերի ֆայլերը վերադարձնում են արդյունքը ինտերնետում, այլապես հարցում կատարեք աշխատանքի վրա, ապա ներբեռնեք այն որպես txt:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=txt" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.txt
Կարդալ API փաստաթղթերը →
Առաջարկել այս էջը
5.0/5 (0)

Ի՞նչ կարող ենք բարելավել: Ձեր կարծիքը օգնում է մեզ լուծել խնդիրները: