OCR PDF:検索可能なPDFの作成
スキャンした家庭の書類を、あとで検索やコピーができる選択可能なテキスト付きPDFにします。日本語・英語・スペイン語・ロシア語に対応し、10ページまで。 ファイルはブラウザー内にとどまります。
認識用ファイルは初回に約26MBで、これに言語データが加わります。
認識されたテキスト
このツールは役に立ちましたか?
例を試す
サンプルをダウンロード言語は「日本語」を選択します。PDFをダウンロードして、請求書、148.50、納品、2048を検索してください。2ページともサンプルと同じ見た目で、テキストを選択してコピーできます。
結果の見方
各ページは画像として順番に認識されます。英語、ロシア語、混在の認識に対応しています。OCRは文字、数字、列、表を誤って読み取ることがあるため、結果を確認してください。 レンダリングしたページ画像と、見えないテキスト層から、新しいPDFを作成します。表示上のページサイズと回転は保持されます。フォーム、リンク、しおり、添付ファイル、デジタル署名は保持されません。既存のテキストは再度認識され、画像の品質はレンダリング解像度に制限されます。
ページは1枚あたり最大4メガピクセルでレンダリングされます。読み込みと各処理ステップは90秒まで、ジョブ全体は10分で停止します。空白のページはテキスト内に記されます。処理に失敗した場合や、テキストが認識されなかった場合は、ダウンロードは提供されません。
保護されたPDFですか?先にパスワードでロックを解除してください。
初回は、変換用のファイルをダウンロードするため、時間がかかることがあります。失敗した場合は、接続を確認するか、より小さなファイルを試してください。「キャンセル」で実行中の処理を止められます。別のファイルを選んで、もう一度実行することもできます。
実用ガイド
スキャンした書類を検索できるように
- 10ページ・10MiBまでのスキャンPDFを選択してください。
- 日本語、英語、スペイン語、ロシア語から選んで、認識を実行してください。
- 結果の中で知っている単語を検索し、テキストレイヤーが機能しているか確認してください。
この例を試す
学校の書類をスキャンした3ページのフォームを認識します(言語:日本語)。2ページ目に印刷された名前を検索すると、できあがったPDFで強調表示されるはずです。
始める前に: 認識に対応するのは日本語・英語・スペイン語・ロシア語のみで、10ページ・10MiBまでです。手書き文字や非常に小さな印字は認識されないことがあります。