PDFをExcelに変換する方法|表を崩さず取り込む
FreePDFチーム ·
PDFは表を共有するには便利でも、その表を使って作業するには最悪です。列を合計したい、 行を絞り込みたい、あるいは50行の数字を打ち直したくないだけでも、その表は平らに 固められたページに閉じ込められたままではなく、スプレッドシートに戻したいはずです。
うまく変換できるもの
表の抽出は、ピクセルではなく構造を読み取ります。そのため結果は、その表がそもそも どう作られたか次第で変わります。
- Excel・Google Sheets・会計ソフトから書き出したPDFは、行と列がきれいに残って いるので、ほぼ完璧に変換できます。
- 罫線がはっきり見え、間隔のそろった表は、複数ページにまたがっていても検出が 簡単です。
- スキャンした表(写真や印刷物)には読み取れる構造がありません。こうしたものは 先にOCRにかけてから変換してください。
ファイルを変換する
- PDF Excel 変換ツールを開き、PDFをアップロードします。
- 検出した表を、それぞれのシート上に行と列として組み直します。
- .xlsxブックをダウンロードし、Excel・Numbers・Google Sheetsで開きます。
逆方向の変換
スプレッドシートから始めて、相手の画面で列がずれないPDFがほしいですか?それは 同じ変換を逆にするだけです。
きれいな結果を得るには
- 改ページで分かれた表は、2つの別々のシートになって出てくることがあります。 変換後に軽く確かめておくと安心です。
- 結合セルや複数行の見出しは、変換後にいちばん見直すことの多い箇所です。 スプレッドシートには、そのまま対応するものがないためです。
- 表が一部しか抜き出せないときは、元ファイルに本物の文字と画像(報告書に貼った スクリーンショットなど)が混ざっている可能性が高いです。先にOCRにかけてください。
よくある質問
表はブックの中にどう配置されますか?
検出した各表は、元のページ名を付けたそれぞれのシートに置かれるので、複数の表が ある文書でも、1つのシートにごちゃ混ぜになることはありません。
スキャンしたPDFでも使えますか?
そのままでは使えません。スキャンには読み取れる本物の表データがなく、あるのは ピクセルだけです。先にOCRにかけてテキスト層を加えてから、Excelに変換してください。