ファイルはお使いの端末に残ります

ファイルの処理はブラウザー内で行われ、当社のサーバーにはアップロードされません。サイトは処理エンジンをダウンロードしたり、ファイルの内容を含まない利用状況やフィードバックのイベントを送信したりすることがあります。

データの取り扱いについて

PDFからExcel

選択可能なテキストを持つ家庭のPDFから表を抽出し、Excelブックにします。1つの表が1シートになり、確認や再計算に使えます。 ファイルはブラウザー内にとどまります。

初回に小さな変換用ファイルをダウンロードします。

PDF・10MiBまで、200ページまで。テキストベースのPDFが対象で、OCRは含まれません。

検出された表

例を試す

サンプルをダウンロード

ブックには、4行3列の1枚のシートが含まれます。セルC4には148.50が入ります。元の表記を保つため、値はテキストとして保存されます。

結果の見方

埋め込みテキストと規則的な表の行を持つPDF向けです。スキャンしたPDFは、先にOCRが必要です。検出では表を見落としたり、テキストが別のセルに入ったりすることがあるため、ダウンロードしたファイルをPDFと見比べてください。結合セルと元の書式は再現されません。

表ごとに、それぞれ別のCSVファイルまたはExcelシートになります。値はテキストのままです。数式として解釈されうるCSVの値には、先頭にアポストロフィが付きます。Excelのセルは明示的にテキストとして保存されます。CSVをスプレッドシートに取り込むときは、先頭のゼロや数値の書式を保つために、列をテキストとして選択してください。

入力は10MiBまで、200ページまで、表は100個まで、セルは100,000個まで、列は256列まで、出力は8MiBまでです。処理は30秒で停止します。行が不揃いな表は、黙ってずらされることなく拒否されます。

初回は、変換用のファイルをダウンロードするため、時間がかかることがあります。失敗した場合は、接続を確認するか、より小さなファイルを試してください。「キャンセル」で実行中の処理を止められます。別のファイルを選んで、もう一度実行することもできます。

エンジンのライセンスとソースコード

実用ガイド

表をスプレッドシートに

  1. スキャン画像ではなく、選択可能なテキストを持つPDFを選択してください。
  2. 「PDFからExcel」を実行して、表を検出・抽出してください。
  3. ブックを開き、各シートを元の表と見比べて確認してください。

この例を試す

5項目が並ぶ2ページの公共料金明細PDFから表を抽出します。ブックには1シートが作られ、5行がPDFの項目列と金額列に一致するはずです。

始める前に: PDFにはあらかじめ選択可能なテキストが必要です。スキャンしたページは先にOCRが必要で、表のレイアウトによっては検出漏れや誤った分割が起こることがあります。