検索可能なPDF

スキャンした PDF に選択可能なテキストレイヤーを追加します。

🔍

スクリーンショットをドラッグ&ドロップまたは貼り付け

画像、PDF、Word (DOCX) またはテキスト - ドラッグ、ブラウズ、貼り付け、URLを使用

🔒 ファイルは 個人的に処理され 自動的に削除されます

スキャンしたページの上に見えない OCR テキスト層を追加して PDF を検索可能にします。スキャンした文書は実際は画像の積み重ねに過ぎません。一つの単語を見つけたり選択したりコピーすることはできません。OCR.chat はテキストを読み取り、オリジナルのスキャン上に正確に配置します。フラットな画像を PDF に変換します。どんな読み取りソフトでも検索と選択が可能です。

これは、数千ページの契約書を条項やフレーズで検索できるような、アーカイブと文書管理のツールです。法律的な発見、記録保存、ファイルキャビネットのデジタル化に不可欠です。テキスト層が見えず、オリジナル画像が触れられないので、スキャンしたページのような見た目を保ちます。

OCR.chatは登録なしで無料で試すことができます。検索可能なPDFは100以上の言語で印刷された文書のためのファストティアで動作します。多ページスキャンは迅速に処理され、Acrobat、Preview、ブラウザ、その他のビューアで動作する標準PDFとしてダウンロードされます。フルテキスト検索とコピー・ペーストが内蔵されています。

どうやって 検索可能なpdf

1
スキャンした PDF をアップロード
検索可能にする PDF ファイルまたはページの画像をドラッグしてください。
2
OCR を実行
OCR.chat reads every page and positions the recognized words exactly where they appear on the scan.
3
見えないテキストレイヤーを取得
テキスト認識は,画像の上に見えない層として追加され,ページは同じように見えるが,検索可能になった。
4
検索可能なPDFをダウンロード
Acrobat、Preview、ブラウザ、その他のリーダーで検索、選択、コピーできる標準の PDF を保存します。

一般的な用途

  • 契約書や記録、書簡をスキャンしてアーカイブし、内容によってどんな文書でも検索できる。
  • 法的発見と全文検討のために スキャンした証拠物と事件ファイルを準備する。
  • 紙文書のファイルキャビネットを検索可能な将来的なPDFライブラリにデジタル化する。
  • 図書館の図書を検索可能にするための検索機能を提供する。
  • 検索可能なテキストをスキャンしたフォームやアプリケーションに追加し,スタッフがエントリを迅速に見つけられるようにする。
  • 検索可能な知識ベースを構築する。

よくある質問

OCR.chat はスキャンしたページのテキストを読み込み、元の画像の上に見えないレイヤーとして追加します。ページは同じに見えますが、隠しテキストは PDF リーダーが単語を検索、選択、コピーできるようにします。

いえ、元のスキャン画像は変更されずに保存され、OCR テキストは上部に見えません。文書はアップロードしたものと同じに見えますが、完全に検索可能になります。

どんな標準的な読み込みソフトでも。出力は通常の PDF です。検索、選択、コピー・ペーストは Adobe Acrobat、Apple Preview、ウェブブラウザ、その他の一般的な読み込みソフトで行えます。

はい。PDFのすべてのページを処理し、テキストレイヤーを全て追加します。それで、検索は最初のページだけでなく、文書全体で動作します。

ファストティアは印刷スキャンに適しており、検索に適したテキストレイヤーを生成します。テキストは見えないので、時々の読み間違いはページの外観を変えません。ダウンロードする前に認識されたテキストを並べて見ることができます。

検索可能なテキスト層は CJK、アラビア文字、キリル文字、インド文字を含む100以上の言語をサポートします。スキャンした PDF をアップロードするだけでなく、PNG、JPG、TIFF 画像もアップロードできます。外国語テキストは翻訳されず、書かれたように転写されます。

少しだけ。見えないテキストレイヤーはページ画像に比べて軽いので、検索可能な PDF は通常、バルーン状になりませんが、元のスキャンに近いサイズになります。見える画像データはそのまま保持されます。

はい、平らで均一に照らされた直線的な写真が最も読みやすいですが、印刷されたページの明るい携帯電話の写真は良いでしょう。深い影、反射、急な角度は正確さを低下させます。できるだけ平らにして、斜めに写らないようにしてください。

クリーンな印刷スキャンは最も信頼できるテキスト層を提供します。消えた、歪んだ、ノイズのあるページは検索可能なテキストを得ますが、誤読の可能性が高くなります。テキストは見えないので、エラーはページの外観を変えません。ダウンロードする前に認識されたテキストを見ることができます。

単一ファイルは速く動作し、長いファイルや多数のファイルをバックグラウンドで処理します。無料プランは月額ページ割当を含み、有料プランは月額$5からページを追加します。バッチ処理は全アーカイブを一度に検索可能にします。

REST API は有料プランで利用できます。それにより、手動でそれぞれをアップロードすることなく、スキャンした PDF を送信し、自分の文書ワークフローから検索可能な PDF を受け取ることができます。

無料アカウントには月額ページ数制限があり、有料プランは月額5ドルから始まり、より多くのページ、バッチ処理、APIアクセスを提供します。ファイルはOCRのみ処理され、自動的に削除され、販売や共有はありません。

API を通してこれを使う

このツールをプログラム的に実行します。一つの POST で実行します。アカウントページから API トークンで認証します。

curl -X POST https://ocr.chat/api/v1/ocr/ \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -F "file=@your-file.pdf" \
  -F "tool=searchable-pdf"

5 ページ以下のファイルはインラインで結果を返します。それ以外の場合はジョブをポールし、次にダウンロードします。 pdf:

curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=pdf" \
  -H "Authorization: Bearer YOUR_API_TOKEN" -o result.pdf
API ドキュメントを読む →
このページを評価
5.0/5 (0)

改善できることは何ですか?フィードバックは問題を解決するのに役立ちます。