PDF を開く
.pdf をここにドロップ、またはクリックして選択
アップロードは行いません。 ファイルはこのタブの JavaScript が読んでいるだけで、あなたのパソコンから出ません —— サーバーは一切見ておらず、タブを閉じればデータは消えます。
PDF の表を Excel に変換する
- PDF を置く. .pdf をドロップします。読み取るのはこのタブの JavaScript です。
- ページを選ぶ. 表が見つかったページが一覧に出ます。中身を見ながら選びます。
- 書き出す. .xlsx なら全ページが 1 ページ 1 シートで入ります。CSV は表示中のページだけです。
なぜコピペだと列が崩れるのか
この作業のいちばん普通のやり方は、PDF ビューアで表を選択してコピーし、Excel に貼る ——「PDF の表を Excel に貼り付ける方法」を説明した記事はいくらでもあります。 そして、たいてい崩れます。
理由は PDF の構造にあります。PDF は表を表として持っていません。 持っているのは「この文字を、この座標に置く」という指示の列だけです。 行も列もセルも、人間が見て初めて成り立つもので、ファイルの中には書かれていません。 だからコピーすると、その座標の情報が落ちて、文字だけが順番に並んで出てきます —— 結果が 1 列に潰れるのはそのためです。
このページがやっているのは、落ちてしまうその座標を使って表を組み直すことです。
罫線ではなく「縦の余白」で列を見つけている
列の切れ目を罫線から探す方法は、意外とうまくいきません。PDF の文字情報の中に罫線は 入っていませんし、そもそも罫線のない表も珍しくないからです。
代わりに使っているのは余白です。ページ上の全部の文字が横方向のどこを占めているかを 重ね合わせると、どの行にも文字が来ない縦の帯ができます。それが列の境界です。 左揃えでも右揃えでも中央揃えでも同じように効きます —— 文字の左端だけを見る方法は、 金額のような右揃えの列で崩れます。
表題や注記の行は、この計算から外しています。見分け方は横にどれだけ伸びているか —— 表の行はテーブルの幅いっぱいに渡りますが、表題や本文はページの一部にしか 広がりません。この 1 本を混ぜてしまうと、列の隙間がふさがって表がまるごと 1 列に潰れます(実際そうなりました)。
列の隙間は最低でも 1 文字ぶんあることを条件にしています。これより狭い隙間まで
列の境界にすると、ABC株式会社 保守料 のような語の間の空きで
セルが割れてしまうためです。裏を返すと、列がぴったり詰まった表は列がくっついたまま
出ます —— 分けられないものを分けたことにして中身をずらすより、そのまま出したほうが
直せるからです。
スキャンした PDF は読めません
紙をスキャンした PDF、スマホで撮った書類の PDF は、このページでは読めません。 中身が画像 1 枚で、文字情報が入っていないからです。文字として取り出すには OCR(光学文字認識)が必要で、このページは OCR をしません。
判定は簡単です。PDF ビューアで表の文字を選択できるか試してください。 選択できれば文字情報があり、このページで読めます。選択できず全体が 1 枚の絵として しか掴めないなら、スキャン PDF です。
この検索結果には AI-OCR 製品を紹介する記事も並んでいます。スキャン PDF が対象なら、 必要なのは確かにそちらです。ここで「できます」と書いてしまうと、 ファイルを置いて何も出てこない、という結果になるだけなので、正直に書いておきます。
ページごとに 1 枚の表として出します
PDF は 1 ページ目が明細で 2 ページ目が内訳、ということが普通にあります。 列の構成が違うページを勝手に連結すると、列がずれた 1 枚の表ができあがり、 しかもエラーは出ません。だからこのページはページごとに独立して列を判定し、 表が見つかったページを一覧に出します。
.xlsx でダウンロードすると、全ページが「1 ページ = 1 シート」で 1 つのブックに 入ります。CSV は 1 枚の表しか持てない形式なので、表示中のページだけです。
崩れやすいものは崩しません
先頭にゼロの付く番号(郵便番号・伝票番号)は文字列のまま、16 桁を超える ID も 指数表記になりません。全角の社名や全角数字も書き換えずにそのまま出します —— 元の帳票がそう書いているものを、こちらの都合で半角に直したりはしません。
文字と文字の間の空白も足しません。PDF は見出しの「金額」を 金 と
額 に割って持っていることがあり、機械的につなぐと「金 額」になります ——
日本語は文字の間に空白を入れないので、それは元の帳票を書き換えたことになります。
実際の間隔を見て、離れていたときだけ空白を入れます。
アップロードしない、そしてそれは確かめられます
PDF はこのタブの JavaScript が解析します。ページの中に送信先がありません —— ブラウザの開発者ツールでネットワークタブを開いたまま操作してみてください。 何も飛ばないのが見えます。
この検索結果で上位に来ているツールは 2 つあり、どちらもファイルをサーバーに 送ります。ところが PDF から表を取り出したい書類は、たいてい請求書・給与明細・ 取引先の名簿 —— 送りたくないものばかりです。2 分の作業のために、 その中身を他社に預ける必要はありません。
毎月同じ PDF が届くなら
これは「いま手元にある 1 つ」を開く道具です。毎月同じ形式の PDF が届いて、 毎月同じ表にする必要があるなら、それは変換ではなく仕組みの話です。 TableDI は自分のパソコンの中だけで動く表計算ワークスペースで、 取り込みと整形を保存して、次に届いたファイルにもそのまま適用できます。
よくある質問
PDF の表を Excel に変換できますか
できます。.pdf をこのページに置くと、中の表を行と列に切り出して .xlsx または CSV で ダウンロードできます。ファイルはアップロードされず、このタブの中だけで処理されます。 ただしスキャンした画像の PDF は読めません(文字情報が無いため)。
コピペで貼ると 1 列に潰れてしまいます
PDF は表を表として持っておらず、「この文字をこの座標に置く」という指示だけを持っています。 コピーするとその座標が落ちるので、文字が順番に並んだだけのものになります。 このページはその座標を使って表を組み直します。
スキャンした PDF でも使えますか
使えません。中身が画像 1 枚で、文字情報が入っていないためです。取り出すには OCR が必要で、 このページは OCR をしません。PDF ビューアで表の文字を選択できるかどうかで見分けられます。
罫線のない表でも大丈夫ですか
大丈夫です。列の切れ目は罫線ではなく縦の余白から見つけています。 逆に、隣の列とほとんど隙間が無い表は 1 列のまま出します —— 分けられないものを 分けたことにして中身をずらすより、そのまま出すほうが直せるからです。
複数ページある PDF はどうなりますか
表が見つかったページが一覧に出て、1 ページずつ表示できます。.xlsx でダウンロードすると 全ページが「1 ページ = 1 シート」で 1 つのブックに入ります。CSV は表示中のページだけです。 ページをまたいで勝手に連結しないのは、ページごとに列の構成が違うことがあるためです。
ファイルはアップロードされますか
いいえ。ページ内に送信先が無いので、ネットワークタブを開いたまま操作すれば確認できます。 タブを閉じればデータは消えます。
パスワードのかかった PDF は開けますか
開けません。PDF ビューアで開いて保護を外したコピーを保存し、そちらを読み込ませてください。
関連ページ
同じことを自分のパソコンの中で
TableDI は、すべてが自分のパソコンの中で動くデスクトップ表計算ワークスペースです。 取り込んで、整えて、可視化する —— 何もアップロードされず、アカウントも要りません。
ずっと無料、試用期間ではありません —— アカウントもカードも不要。現在は macOS 版、Windows 版は準備中。有料版で増えるもの。
最終確認 2026-09-01、TableDI チーム。このページに間違いがありますか? お知らせください —— 受信箱はひとつで、TableDI を作っている人間が読んでいます。