「書類はスキャンしているのに、必要なときに見つからない」
書類のスキャン整理に取り組んだ士業事務所から、よく聞く悩みです。スキャナは買った、PDFにもなっている。それでもフォルダを開くと「IMG_0123.pdf」「スキャン_20260912.pdf」が何十件も並び、結局は紙の原本を探しに行く。ペーパーレス化が止まる原因は、スキャンする工程ではなく、その直後の「名前を付けて、所定の場所に入れる」工程にあります。
結論から言うと、この工程は人の手から外せます。スキャン直後のPDFをAIに読ませ、日付・取引先・金額を抜き出してファイル名を付け、決まったフォルダへ振り分ける。人が見るのは提案された名前の確認だけです。当社は不動産鑑定事務所として、領収書・振替明細・名刺をこの方法で毎月処理しています。本記事では、ファイル自動仕分けの仕組みと、AIに任せる場合の精度と確認工程を、当社の実際の手順をもとに整理します。
書類のスキャン整理が続かない3つの理由
スキャン後の「名前付け」が人の作業として残っている
複合機やドキュメントスキャナは、ファイル名を連番か日時でしか付けられません。中身を見て「20260410_レターパック_430」と名付ける作業は人に残ります。1件30秒でも、月に50件あれば25分。忙しい週に後回しにされ、未整理のPDFが溜まり始めます。
保存先の判断が毎回発生する
「これは経費か、案件資料か、名刺か」「どの年度のフォルダか」。判断が1回入るたびに手が止まります。迷ったファイルはいったんデスクトップに置かれ、そのまま戻ってきません。
紙の原本と保管場所が二重になる
スキャンしたあとも原本を残すなら、紙とPDFの両方に整理ルールが要ります。どちらか一方が崩れると、「PDFはあるはずだが見つからないので原本を探す」という最も手間のかかる状態になります。
ファイル自動仕分けの仕組みは4つの部品でできている
部品1:スキャンの受け口を1か所に固定する
最初にやることは、スキャナの保存先を1つのフォルダに固定することです。当社はクラウド同期されたフォルダを受け口にし、スキャナから届くPDFはすべてそこに入ります。受け口が1つなら、自動処理は「このフォルダにある未処理のPDF」だけを見ればよくなります。
部品2:書類の種類ごとの「ルール表」を作る
自動仕分けの心臓部はAIではなく、書類の種類ごとのルール表です。当社は次の項目を書類の種類ごとにまとめた1枚のテキストファイルを持っています。
| 項目 | 内容 | 例(レターパック領収書) |
|---|---|---|
| 判定キーワード | 種類を見分ける文言 | 「レターパックライト」 |
| 読み取り位置 | 日付・金額が書かれた場所 | 上部の日付、「合計」欄 |
| ファイル名の型 | 日付_名称_金額 | 20260410_レターパック_430 |
| 移動先 | 年度・区分のフォルダ | 第1期_領収書 |
ファイル名の考え方は、電子帳簿保存法の対応でつまずくのは「検索」で紹介した「日付_取引先_金額_種別」と同じです。ルール表に載っている書類は自動で、載っていない書類は人に回す、という線引きがはっきりします。
部品3:AIに読ませて「名前の候補」を出させる
ここでAIの出番です。PDFからテキストを取り出し、ルール表と照らして種類を判定し、日付・金額・取引先を抜き出してファイル名の候補を作らせます。文字の読み取りはOCR(画像の文字をテキストデータに変換する技術)が担い、AIは「どの数字が合計金額か」「どの日付が発行日か」を文脈で見分ける役割です。
部品4:人が確認してから移動する
AIが出した候補は、そのまま確定させません。「この5件をこの名前でこのフォルダに移します」という一覧を人が見て、問題なければ実行します。当社では、確認待ちの一覧が出るまでの処理をAIに任せ、確定の判断だけを人が持っています。
書類のスキャン整理を自動化した当社の手順
名前の先頭に「未処理」の印を付ける
当社のファイル名は「[未]20260410_レターパック_430.pdf」の形です。先頭の[未]は、会計ソフトへの登録がまだであることを示す印で、登録が済んだら外します。フォルダを開けば、まだ帳簿に載っていない書類がひと目で分かります。仕分けと経理の進み具合を、ファイル名だけで管理できるわけです。
年度フォルダは日付から自動で決める
移動先の年度は、抜き出した日付と決算月から決まります。当社は7月決算なので、2026年8月以降の日付なら翌期のフォルダです。期をまたぐ月の書類を人が間違えて入れることがなくなりました。
名刺も同じ仕組みに載せる
この仕組みは経費書類専用ではありません。当社は名刺もスキャンし、AIに会社名・氏名・連絡先を読み取らせて、名刺画像の保存と顧客メモの作成までを1回の処理で行っています。受け口とルール表という骨組みが同じなら、書類の種類は後から増やせます。毎月決まった処理を決まった手順で回す考え方は、定型業務の自動化で年間何時間浮くかでも詳しく紹介しています。
AIに読ませる場合の精度と、確認工程を省いてはいけない理由
間違えやすいのは日付と金額
当社の運用で読み取りを誤りやすいのは、文字そのものより「どれを採るか」です。請求書に発行日と支払期日が並んでいる、領収書に小計と合計がある、振替明細に複数の日付がある、といった場面です。ルール表に「合計欄を採る」「発行日を採る」と書いておくと誤りは大きく減りますが、ゼロにはなりません。
手書き・感熱紙・かすれは人に回す
手書きの領収書、色あせた感熱紙のレシート、斜めに取り込まれた書類は、OCRの段階で文字が欠けます。テキストを取り出せなかったファイルは、AIに推測させず「読めませんでした」と返させて人が処理する設計にしてください。AIがもっともらしい数字を作ってしまう現象(ハルシネーション)への対策は、ハルシネーションとは?士業業務でAIの誤りを防ぐ検証の型で整理しています。
スキャナ保存で原本を捨てるなら要件の確認が先
スキャンした書類の紙原本を廃棄したい場合、電子帳簿保存法のスキャナ保存の要件を満たす必要があります。解像度200dpi以上、原則カラー256階調での読み取り、受領後最長でおおむね2か月と7営業日以内のタイムスタンプ付与(または訂正削除の履歴が残るシステムでの保存)などです。2024年1月以後は解像度等の情報の保存や入力者情報の確認は不要になりましたが、自動仕分けの仕組みを作っただけで要件を満たすわけではありません。原本の廃棄を前提にする場合は、税理士にご確認ください。
想定されるケース:月50件の書類を扱う事務所
所長1名・スタッフ1名で、領収書・明細・名刺を合わせて月50件スキャンする事務所を想定します。
| 工程 | 手作業 | 自動仕分け後 |
|---|---|---|
| 名前付け・移動 | 1件30秒×50件=25分 | 一覧の確認5分 |
| 読み取れない書類の処理 | — | 5件×1分=5分 |
| 月末の探し物・突合 | 約60分 | 約15分 |
| 月の合計 | 約85分 | 約25分 |
月60分、年間で約12時間の削減です。ルール表の作成に最初の2〜3時間かかりますが、書類の種類が10種類程度なら1日で形になります。数字は当社の運用実感に基づく試算で、書類の量や種類によって変わります。
まとめ
書類のスキャン整理が続かないのは、スキャンの後に人の判断が残っているからです。受け口を1つにし、書類ごとのルール表を作り、AIに名前の候補を出させて人が確定する。この形にすれば、ペーパーレス化は止まりにくくなります。
要点を振り返ります。
- 整理が止まる原因はスキャンではなく、直後の名前付けと保存先の判断
- 自動仕分けは「受け口」「ルール表」「AIの読み取り」「人の確認」の4つの部品で組む
- 心臓部はAIではなくルール表。載っている書類は自動、載っていない書類は人に回す
- 誤りやすいのは発行日と支払期日、小計と合計の取り違え。読めない書類は推測させない
- 原本を廃棄するならスキャナ保存の要件確認が別に必要
紙の書類を毎月スキャンしているのに探し物が減らない士業事務所の経営者様は、まずよく届く書類を3種類選び、ルール表を書くところから始めてください。それだけで、自動化できる範囲が見えてきます。
当社は、鑑定事務所として自社で使い込んだファイル自動仕分けの仕組みを、そのまま事務所に合わせて組み立てるご支援をしています。どの書類から自動化すべきか整理したい方は、無料相談をご利用ください。




