PDFの表をExcelに移したら確認したい5つのこと

PDFの表をExcelへ移せても、それだけで確認は終わりません。見た目が整っていても、商品コードのゼロが消えたり、単価の桁を読み違えたりすることがあります。この記事では、変換後に確かめたい5つの項目を、小さな表で順番に見ていきます。

以下はすべて架空の商品表を使った解説例です。特定の変換サービスの実測結果や、実際の取引記録ではありません。

まずは元の表を手元に残す

PDFの原本を残し、変換したExcelと並べて開きます。ここでは税や送料を含まない、次の3行を使います。金額の単位は円です。

元のPDFに載っている表(架空)
商品コード数量単価金額
0012334801,440
0456021,2502,500
008081980980
合計4,920

対応するExcel環境では、Power QueryのPDF取り込みで表を選び、変換画面で内容を確認できます。機能やメニューは製品・環境によって異なるため、自分の画面でPDFを取り込めるか確認してください。操作の流れはMicrosoftのPDFコネクタ解説にあります。

1.行数と列の位置が合っているか

最初に「見出しと合計行を除く明細3行・4列」が保たれているか確認します。ページをまたぐ表では、見出しが途中に混ざったり、最終行が抜けたりすることがあります。商品名などが折り返されていると、1件が2行に分かれる場合もあります。元のPDFと、最初・最後・ページの境目を照合しましょう。

次は、説明のために誤りを入れた変換例です。行数が合っていても、内容まで正しいとは限りません。

誤りのある変換例
商品コード数量単価金額
12334801,440
456021252,500
8081980980
合計4,920

2.先頭ゼロと長い番号が残っているか

商品コードは計算する数値ではなく識別子です。「00123」と「123」を同じものとして扱わず、取り込み時にコード列を文字列に設定します。手で貼り付ける場合も、貼り付け先を先に文字列形式にします。

Excelの数値の有効桁数は15桁です。16桁以上の管理番号は、数値として取り込むと末尾の桁が失われることがあります。後から文字列に変えても、失われた値は復元できません。元データから取り込み直してください。詳しくはMicrosoftの先頭ゼロと長い数値の説明を参照できます。

3.数値、単位、小数点が合っているか

例の2行目は、単価「1,250」が「125」になっています。桁区切りのカンマと小数点、マイナス記号、円と千円、個と箱を原本で確認します。空欄を勝手にゼロで埋めないことも大切です。

数字に見えても文字列のままの場合があります。数量・単価・金額の列は計算できる数値にそろえ、コード列だけ文字列として扱います。右寄せ・左寄せなどの見た目だけで判断せず、セルの値と形式を確認しましょう。

4.数量×単価が明細金額と一致するか

見出しを1行目、商品コードをA列、数量をB列、単価をC列、金額をD列に置いたなら、確認用のE2に=B2*C2、F2に=D2-E2を入れて3行分コピーします。差額がゼロでない行を原本と照合します。空欄は計算上ゼロとして扱われる場合があるため、差額がゼロでも、数量・単価・金額に空欄があれば確認済みにしません。誤り例の2行目では、2×125=250円となり、金額2,500円との差2,250円が見つかります。

実際の表で値引きや端数処理がある場合は、そのルールも確認します。差額を消すためだけに元の金額を書き換えないでください。

5.合計だけを見て終わっていないか

=SUM(D2:D4)で明細を合計し、PDFの合計と比較します。ただし、今回の誤り例は金額列が正しいため、合計だけなら4,920円で一致します。コードや単価の誤りは残ったままです。行数・識別子・各明細の確認を組み合わせましょう。

原本と照合して修正した表
商品コード(文字列)数量単価金額
0012334801,440
0456021,2502,500
008081980980
合計4,920

AIに抽出を頼むときの指示文

PDFや画像を扱えるAIには、次のように指定できます。出力後の照合は人が行います。

添付PDFの表を「商品コード・数量・単価・金額」の順で抽出してください。商品コードは先頭ゼロを含めて原文どおり残してください。合計行は明細と分け、元のページ番号も示してください。読めない値は推測せず「要確認」とし、該当箇所を列挙してください。空欄をゼロにせず、金額を勝手に再計算・修正しないでください。

スキャンPDFは文字認識の確認も必要

文字を選択・コピーできないスキャンPDFでは、画像から文字を読むOCRなどが必要になることがあります。たとえばPower Automateの通常の表抽出はOCRを使わず、コピーできない文字を抽出できません。これは同機能の公式説明にある制約です。別の変換機能やAIが画像を扱えるかは、それぞれ確認してください。

OCRを使っても、薄い文字や傾いた原稿では「0とO」「1とI」などを読み違える可能性があります。読めない箇所は原本を拡大して確認し、判別できるまで保留にします。

出典・確認日

公式情報の確認日:2026年10月4日。画面や対応機能は更新される場合があります。

上部へスクロール