PDF からテキスト
スキャンしたまたはデジタルのPDFをプレーンテキストに変換します。
スクリーンショットをドラッグ&ドロップまたは貼り付け
画像、PDF、Word (DOCX) またはテキスト - ドラッグ、ブラウズ、貼り付け、URLを使用
🔒 ファイルは 個人的に処理され 自動的に削除されます
OCR.chat は PDF からテキストを抽出します。デジタルエクスポートかスキャンしたページの積み重ねかに関わらず。複数ページの PDF をアップロードすると、すべてのページが処理され、コピー可能な結果に結合されます。既に実際のテキストレイヤーを含むページは、即座に損失なしに読み込まれ、スキャンしたページは自動的に OCR を実行します。それによって、ファイルが提供する最も正確なテキストを常に得ることができます。
このPDFからテキストへの変換は、長い文書を扱う人々のために作られました。研究者は古い論文を掘り出し、法律相談者は事件ファイルを検索可能なテキストに変換し、分析者はスキャンしたレポートから数字を引出します。100 以上の言語を読み込み、抽出されたテキストを原稿のページの隣に表示して、検討を行います。外国語の単語を無音で翻訳しません。多言語のPDFは入力したとおりに出力されます。
登録は必要ありません。高速なエンジンは標準的な印刷された PDF を無料で扱います。文書に濃い表、列、手書きが含まれている場合、プレミアム AI エンジンはより高い精度を提供します。結果をプレーンテキスト、Markdown、Word、CSV、JSON としてダウンロードしてください。ファイルは OCR のために処理され、その後自動的に削除されます。
どうやって pdf からテキスト
一般的な用途
- 研究者はスキャンした論文や本から文章や引用を抽出する。
- 弁護士と法律助手が スキャンした事件ファイルと契約を検索可能なテキストに変換する
- 会計士がスキャンした財務諸表から 数字と行の項目を引く
- 歴史記録や廃刊文書を保存のためにデジタル化する記録者。
- 従来のPDFファイルのコンテンツを再利用するためのソフトウェアである。
- ジャーナリストが政府や裁判所のPDFを 特定の名前や用語で探してる
よくある質問
API を通してこれを使う
このツールをプログラム的に実行します。一つの POST で実行します。アカウントページから API トークンで認証します。
curl -X POST https://ocr.chat/api/v1/ocr/ \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-F "file=@your-file.pdf" \
-F "tool=pdf-to-text"
5 ページ以下のファイルはインラインで結果を返します。それ以外の場合はジョブをポールし、次にダウンロードします。 txt:
curl -L "https://ocr.chat/api/v1/ocr/JOB_UUID/download/?format=txt" \
-H "Authorization: Bearer YOUR_API_TOKEN" -o result.txt
API ドキュメントを読む →