ପାଠ୍ୟକୁ PDFName
ସ୍କାନିତ କିମ୍ବା ଡିଜିଟାଲ PDFଗୁଡ଼ିକୁ ସାଦା ପାଠ୍ୟରେ ପରିବର୍ତ୍ତନ କରନ୍ତୁ।
ସ୍କ୍ରିନସଟକୁ ଟାଣି ଆଣନ୍ତୁ ଏବଂ ଛାଡିଦିଅନ୍ତୁ କିମ୍ବା ଲଗାନ୍ତୁ
ପ୍ରତିଛବି, PDF, Word (DOCX) କିମ୍ବା ପାଠ୍ୟ - ପକାଇବେ, ବ୍ରାଉଜ କରନ୍ତୁ, ଲଗାନ୍ତୁ, କିମ୍ବା URL ବ୍ୟବହାର କରନ୍ତୁ
🔒 ଆପଣଙ୍କର ଫାଇଲଗୁଡ଼ିକ ବ୍ୟକ୍ତିଗତ ଭାବରେ ପ୍ରକ୍ରିୟାଗତ ହୋଇଥାଏ ଏବଂ ସ୍ୱୟଂଚାଳିତ ଭାବରେ ଅପସାରଣ ହୋଇଥାଏ।
OCR.chat ଯେକୌଣସି PDFରୁ ପାଠ୍ୟକୁ କାଢ଼ିଥାଏ, ଏହା ଡିଜିଟାଲ ରପ୍ତାନୀ ହେଉ ଅବା ସ୍କାନିତ ପୃଷ୍ଠାଗୁଡ଼ିକର ଗୋଟିଏ ଷ୍ଟାକ। ଏକ ବହୁ-ପୃଷ୍ଠା PDFକୁ ଅଲଗା କରନ୍ତୁ ଏବଂ ପ୍ରତ୍ୟେକ ପୃଷ୍ଠାକୁ ପ୍ରକ୍ରିୟାକରଣ କରାଯାଏ ଏବଂ ଗୋଟିଏ ସ୍ୱଚ୍ଛ, ନକଲ-ସଜ୍ଜିତ ଫଳାଫଳରେ ସଂଯୋଜିତ କରାଯାଏ। ପୃଷ୍ଠାଗୁଡ଼ିକ ଯେଉଁଥିରେ ପୂର୍ବରୁ ଗୋଟିଏ ପ୍ରକୃତ ପାଠ୍ୟ ସ୍ତର ଥାଏ ତାହା ତୁରନ୍ତ ଏବଂ କ୍ଷତିହୀନ ଭାବରେ ପଢ଼ାଯାଏ, ଯେତେବେଳେ ସ୍କାନିତ ପୃଷ୍ଠାଗୁଡ଼ିକ OCR ମାଧ୍ୟମରେ ସ୍ୱୟଂଚାଳିତ ହୋଇଥାଏ, ତେଣୁ ଆପଣ ସର୍ବଦା ସବୁଠାରୁ ସଠିକ ପାଠ୍ୟକୁ ପାଇବେ ଯାହା ଫାଇଲ ପ୍ରଦାନ କରିଥାଏ।
ଏହି PDFରୁ ପାଠ୍ୟ ପରିବର୍ତ୍ତକଟି ଲୋକମାନଙ୍କ ପାଇଁ ନିର୍ମିତ ଯାହାକି ଲମ୍ବା ଦଲିଲ ସହିତ କାମ କରନ୍ତି: ଗବେଷକ ପୁରୁଣା କାଗଜଗୁଡ଼ିକୁ ଖନନ କରନ୍ତି, ପାରାଲିଗଲ ଫାଇଲଗୁଡ଼ିକୁ ସନ୍ଧାନଯୋଗ୍ୟ ପାଠ୍ୟରେ ପରିବର୍ତ୍ତନ କରନ୍ତି, ଏବଂ ବିଶେଷଜ୍ଞମାନେ ସ୍କାନ କରାଯାଇଥିବା ରିପୋର୍ଟରୁ ଆକଳନକୁ କାଢ଼ିଥାନ୍ତି। ଏହା 100ରୁ ଅଧିକ ଭାଷାକୁ ପଢ଼େ, ଅନୁଧ୍ୟାନ ପାଇଁ ପ୍ରାଥମିକ ପୃଷ୍ଠା ପଛପଟରୁ କାଢ଼ିବା ପାଠ୍ୟକୁ ଦର୍ଶାଇଥାଏ, ଏବଂ କେବେ ବିଦେଶୀ ଶବ୍ଦଗୁଡ଼ିକୁ ନିଶବ୍ଦ ଭାବରେ ଅନୁବାଦ କରେ ନାହିଁ, ତେଣୁ ଏକ ବହୁଭାଷୀ PDF ଠିକ ଭାବରେ ଏହା ଯେପରି ଆସେ ସେହିପରି ବାହାରକୁ ଆସେ।
ଏହାକୁ ଚେଷ୍ଟାକରିବା ପାଇଁ କୌଣସି ସଦସ୍ୟତା ଆବଶ୍ୟକ ନାହିଁ, ଏବଂ ଦ୍ରୁତ ଯନ୍ତ୍ରଟି ମାନକ ମୁଦ୍ରଣ PDFଗୁଡ଼ିକୁ ମୁକ୍ତ ଭାବରେ ପରିଚାଳନା କରିଥାଏ। ଯେତେବେଳେ ଗୋଟିଏ ଦଲିଲରେ ଘନ ସାରଣୀ, ସ୍ତମ୍ଭ, କିମ୍ବା ହସ୍ତଲିଖନ ଅଛି, ପ୍ରିମିଆ AI ଯନ୍ତ୍ରଟି ଉଚ୍ଚ ସଠିକତା ପ୍ରଦାନ କରିଥାଏ। ଫଳାଫଳକୁ ସରଳ ପାଠ୍ୟ, Markdown, Word, CSV, କିମ୍ବା JSON ଭାବରେ ଆହରଣ କରନ୍ତୁ, ଏବଂ ନିଶ୍ଚିତ ହୁଅନ୍ତୁ ଯେ ଆପଣଙ୍କ ଫାଇଲ OCR ପାଇଁ ପ୍ରକ୍ରିୟାକୃତ ହୋଇଥାଏ ଏବଂ ତାପରେ ସ୍ୱୟଂଚାଳିତ ଭାବରେ ଅପସାରଣ ହୋଇଥାଏ।
କିପରି ପାଠ୍ୟକୁ pdfname
ସାଧାରଣ ବ୍ୟବହାର ବିଧି
- ଗବେଷକମାନେ ସ୍କାନ କରାଯାଇଥିବା ଜର୍ଣ୍ଣାଲ ଲେଖା ଏବଂ ପୁସ୍ତକରୁ ପାଠ ଏବଂ ଉଦ୍ଧୃତ ଅଂଶକୁ ବାହାର କରୁଛନ୍ତି ।
- ଆଇନଜୀବୀ ଏବଂ ପରାମର୍ଶଦାତାମାନେ ସ୍କାନ କରାଯାଇଥିବା ମାମଲା ଫାଇଲ ଏବଂ ଚୁକ୍ତିକୁ ସନ୍ଧାନଯୋଗ୍ୟ ପାଠ୍ୟରେ ପରିବର୍ତ୍ତନ କରୁଛନ୍ତି ।
- ସ୍କାନ କରାଯାଇଥିବା ଆର୍ଥିକ ରିପୋର୍ଟରୁ ଆକଳନକାରୀମାନେ ସଂଖ୍ୟା ଏବଂ ରେଖାଗତ ବିଷୟକୁ ବାହାର କରୁଛନ୍ତି ।
- ଐତିହାସିକ ରେକର୍ଡ ଏବଂ ସଂରକ୍ଷଣ ପାଇଁ ଅପ୍ରତିଷ୍ଠିତ ଦସ୍ତାବିଜକୁ ଡିଜିଟାଲୀକରଣ କରିବା ଲାଗି ଅଭିଲେଖକ
- ଅଫିସ କର୍ମଚାରୀମାନେ ପୁରୁଣା PDF ଗୁଡିକରୁ ବିଷୟବସ୍ତୁକୁ ପୃଷ୍ଠା ପରେ ପୃଷ୍ଠା ପୁନଃଟାଇପ ନକରି ପୁନଃବ୍ୟବହାର କରିଥାନ୍ତି।
- ସାମ୍ବାଦିକମାନେ ସରକାରୀ ଏବଂ କୋର୍ଟର ଦୀର୍ଘ ପିଡିଏଫରେ ନିର୍ଦ୍ଦିଷ୍ଟ ନାମ ଏବଂ ଶବ୍ଦ ପାଇଁ ଖୋଜୁଛନ୍ତି ।
ସାଧାରଣ ପ୍ରଶ୍ନ
API ମାଧ୍ୟମରେ ଏହାକୁ ବ୍ୟବହାର କରନ୍ତୁ
ଗୋଟିଏ POST ସହିତ ଏହି ସାଧନକୁ ପ୍ରଗ୍ରାମମୂଳକ ଭାବରେ ଚଲାନ୍ତୁ। ଆପଣଙ୍କ ଖାତା ପୃଷ୍ଠାରୁ API ଟୋକନ ସହିତ ବୈଧିକରଣ କରନ୍ତୁ।
curl -X POST https://ocr.chat/api/v1/ocr/ \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-F "file=@your-file.pdf" \
-F "tool=pdf-to-text"
5ପ୍ରକରଣ କିମ୍ବା କମ୍ ଫାଇଲଗୁଡ଼ିକ ରେଖାଗତ ପରିଣାମକୁ ଫେରାଇଥାଏ; ଅନ୍ୟଥା କାର୍ଯ୍ୟକୁ ପଚାରିବା, ତା'ପରେ ଏହାକୁ ଆହରଣ କରନ୍ତୁ txt:
curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=txt" \
-H "Authorization: Bearer YOUR_API_TOKEN" -o result.txt
API ଦଲିଲଗୁଡ଼ିକୁ ପଢନ୍ତୁ →