可搜索 PDF
将可选文本层添加到扫描的 PDF 中。
拖放,或粘贴一个截图
图像、 PDF、 Word (DOCX) 或文本 - 投放、浏览、粘贴或使用 URL
🔒 您的文档是私下处理并自动删除的。
通过在扫描页面上添加隐性 OCR 文本层, 使 PDF 可搜索。 扫描文档其实只是一堆图像, 无法在其中找到、 选择或复制一个单词。 OCR.chat 读取文字, 并精确地放在原始扫描上, 将平面图像转换成一个 PDF, 可以在任何阅读器中搜索和选择 。
这是归档和文件管理的工具,通过条款或短语在数千页中找到合同是整个要点。 对于法律发现、记录保存和档案柜数字化至关重要,因为文本层是隐形的,原始图像没有被移动,所以使您的网页保持扫描的准确性。
OCR.chat 无需注册即可尝试。 快速的PDF 运行在快速的层次上, 打印文件使用100多种语言, 因此多页扫描会被快速处理并下载为标准的 PDF, 用于 Acrobat、 Prevision、 您的浏览器和任何其他查看器, 并安装全文搜索和复制纸 。
如何 可搜索 pdf
1
上传扫描过的 PDF
丢弃到扫描过的 PDF 或页面图像中, 以便查找。
2
运行 OCR
OCR.chat读到每页 并定位 识别的单词 准确的位置 它们在扫描上出现。
3
获取不可隐化的文本层
识别的文字被添加为原始图像上的无形层, 因此页面看起来完全相同, 现在可以搜索 。
4
下载可搜索的 PDF
保存标准的 PDF, 您可以在 Acrobat、 Preabad、 您的浏览器或任何阅读器中搜索、 选择和复制 。
通用用途
- 档案扫描合同、记录和信件,以便根据内容查找文件。
- 准备扫描物证和案件档案,以便依法发现和全文审查。
- 将纸质文件的档案柜数字化,进入一个可搜索的、未来防伪的PDF图书馆。
- 使扫描书籍、手册和参考资料可供搜索,以供研究和引用。
- 在扫描表格和应用程序中添加可搜索文本,以便工作人员能够快速找到条目。
- 利用扫描发票、报表和审计收据,建立可搜索的知识库。
经常问到的问题
OCR.chat读取每页扫描页面上的文字,并将其添加为对齐原始图像的无形层。页面看起来完全相同,但隐藏的文字允许任何PDF阅读器从中查找、选择和复制文字。
否。原始扫描图像未保存,而OCR文本在顶部不可见地处于最上面,因此文档与您上传的文件看起来完全相同,而您则完全可以搜索。
任何标准阅读器。 输出是普通 PDF, 因此在 Adobe Acrobat、 Apple Preavision、 您的网络浏览器和其他共同浏览器中进行搜索、 选择和复制版打印工作 。
是的。PDF的每页都经过处理,文本层通篇都添加,因此整个文件的搜索工作是全文件的搜索工作,而不仅仅是第一页。
快速层非常适合打印扫描并生成可靠的文本层以搜索。 由于文本是隐形的, 偶尔误读不会改变页面的外观, 您可以在下载前同时检查得到承认的文本 。
可搜索文本层支持100多种语言, 包括 CJK 、 阿拉伯语、 西里尔语和印度语脚本。 您可以上传扫描过的 PDF 以及 PNG、 JPG 和 TIFF 图像, 外国文本被抄录为已写, 从未翻译过 。
略微略微。 与页面图像相比, 隐性文字层的重量较轻, 所以可搜索的 PDF 通常与原始扫描的大小接近, 而不是气球。 可见图像数据会保留不变 。
是的,尽管平坦、平淡、直线捕捉的读数最好。 打印页面清晰的电话照片效果很好;厚厚的阴影、光线或斜角可以降低精度,这样平整页面,避免在可以的地方扭曲。
清洁打印扫描给出最可靠的文本层。 面部、 斜面或噪音页面仍然可以得到可搜索的文本, 但读错的可能性更大。 由于文本是隐形的, 误差永远不会改变页面的外观, 您可以在下载前查看被识别的文本 。
单个文件运行快速, 且在背景中长或多文件的工作进程。 免费使用包括每月的页面津贴; 5美元/ mo的付费计划会增加更多页( 信用计数作为页数) 和批量处理, 以便您能够同时搜索整个档案 。
是的。在付费计划中可以提供REST API,这样您就可以发送扫描的PDFs,并从自己的文件工作流程中接收可搜索的PDFs,而不必手上上传每个文件。
免费免费申请无需注册,免费账户包括每月的页面补贴,包括5美元/月的纸面、批量处理和API访问费。 文件只为OCR处理,自动删除,从未出售或共享。
通过 API 使用此功能
程序运行此工具时使用一个 POST 。 验证时使用账户页面上的 API 符号 。
curl -X POST https://ocr.chat/api/v1/ocr/ \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-F "file=@your-file.pdf" \
-F "tool=searchable-pdf"
5页以下的文件, 5页以下的文件返回结果内线; 否则对任务进行民意调查, 然后按 pdf:
curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=pdf" \
-H "Authorization: Bearer YOUR_API_TOKEN" -o result.pdf
读取 API 文档 →