ファイルはお使いの端末に残ります

ファイルの処理はブラウザー内で行われ、当社のサーバーにはアップロードされません。サイトは処理エンジンをダウンロードしたり、ファイルの内容を含まない利用状況やフィードバックのイベントを送信したりすることがあります。

データの取り扱いについて

PDFからテキスト

検索できる書式やガイドにすでにあるテキスト層を、メモに貼り付けられるプレーンテキストのファイルにコピーします。スキャンには先にOCRが必要です。

サンプルは合成データです。実行する前に操作の設定を確認してください。

ドキュメントはこの端末に残ります。ツールのダウンロードと利用統計には、ファイルの内容は含まれません。

端末での制限: 1ファイルの最大サイズ: 10 MB

ファイルはお使いのブラウザー内で処理されます。このサイトにはアップロードされません。

実践ガイド

PDFにすでにある文章を再利用する

  1. 印刷されたページのスキャンではなく、選択できるテキストを含むPDFを選択してください。
  2. テキストを抽出し、ページの区切りと読む順番を確認してください。
  3. TXTの結果をコピーまたはダウンロードし、重要な値をPDFと見比べてください。

この例を試す

検索できる2ページの申込ガイドからテキストを抽出し、フィールドのラベルと説明がTXTの結果の中で使える順番で並んでいることを確認します。

変更前

  • 選択可能なPDFのテキスト

変更後

  • プレーンテキスト .txt
このタスクの入力と、期待される結果 説明用の例です。

始める前に: 埋め込まれた選択できるテキストを読み取ります。スキャンしたページにはOCRが必要で、段組みは見た目の順番どおりにならないことがあります。

元のPDFで作業を続ける
得られる結果

埋め込まれたテキストをTXTファイルに抽出します。スキャンされたページにはOCRが必要です。元の読み順は、見た目のレイアウトと異なる場合があります。

制限事項と重要な注意点

入力は10MiB、200ページ、出力テキストは4MiBまでです。テキストレイヤーのないスキャン文書では、抽出に成功したように見せかけず、エラーが表示されます。読み順、段組み、フォントは見た目のレイアウトと一致しない場合があります。OCRでもPDFからWordへの変換でもありません。

例

検索可能なレポートからテキストを抽出し、結果欄で確認して、コピーまたはダウンロードしてください。テキストの結果の後も、元のPDFは引き続き使えます。