この記事は、書類をあとから探しやすくするための整理方法と、手段の選び分けをまとめたものです。書類の保存義務や保存期間、原本を廃棄してよいかどうか、電子帳簿保存法上の要件といった制度面には触れていません。何をいつまで持っておく必要があるかは書類の種類ごとに違いますので、顧問税理士・顧問弁護士、または所管の窓口にご確認ください。
書類保管の見直しでよくある失敗
- 倉庫に預けたら、月に何度も引く書類まで一緒に出してしまい、出庫依頼が業務になった
- スキャン代行から戻ってきたPDFが 0001.pdf からの連番で、結局どれが何か分からない
- 文書管理システムを入れたが、登録時の入力項目が多すぎて誰も使わなくなった
- ファイルサーバーの全文検索を入れたのに、スキャンしたPDFだけ1件もヒットしない
- キャビネットは空いたが、「あの書類どこ?」と聞かれる回数は前と変わっていない
これらに共通しているのは、「置き場所の問題」として着手して、「探す問題」が手つかずのまま残ったことです。紙は物理的に減るので、片付いた感じはします。けれど探す側から見ると、キャビネットが倉庫やフォルダに置き換わっただけで、手がかりが増えていません。
むしろ悪化することがあります。キャビネットなら背表紙を眺めて当たりが付きましたが、倉庫に出すと目視ができなくなり、連番PDFのフォルダも目視ができないからです。
選択肢は5つ。それぞれ別の問題を解いている
「書類保管」「書類管理ツール」で調べると、性質のまったく違うものが横並びで出てきます。まず何がどの問題を解くのかを分けておくと、比較しやすくなります。
| 手段 | 解く問題 | 解かない問題 |
|---|---|---|
| 書類保管サービス(外部倉庫) | 社内の場所が足りない | 探す速さ。出庫の手続きぶん、むしろ遅くなる |
| スキャン代行 | 紙をPDFにする手間 | ファイル名。標準は連番で戻ることが多い |
| 文書管理システム | 属性を付けて検索・権限管理する | 登録時の入力。全社の運用が乗るかどうか |
| 全文検索(ファイルサーバー) | 本文の中の語で引く | 文字情報の無いスキャンPDFは引けない |
| 自動リネーム | PDFの名前を中身に合わせて揃える | 紙そのものは減らない。権限管理もしない |
この表で伝えたいのは優劣ではありません。どれか1つで全部が片付くことはない、ということです。実際には組み合わせになりますし、組み合わせる順番を間違えると最初の失敗例のようになります。
「保管コスト」を場所代だけで見ない
外部倉庫を検討するとき、比較されるのはたいてい箱あたりの月額と、社内スペースの賃料換算です。この計算自体は正しいのですが、抜けている項目があります。出庫にかかる時間です。
依頼から到着まで数日かかるのが普通で、急ぎなら別料金がかかります。年に1回しか引かない書類なら誤差ですが、月に数回引く書類が混ざっていると話が変わります。1回の出庫のたびに担当者が依頼を書き、到着を待ち、返却の手配をします。この時間は、削減した賃料に簡単に追いつきます。
だから最初にやるべきなのは、業者を比べることでも、システムを比べることでもありません。手元の書類を引かれる頻度で分けることです。
書類を3つに分ける。判断はこれだけで付く
種類ごとに細かく分類する必要はありません。次の3つで足ります。
- A: 月に1回以上引かれる — 手元に置く。電子化して、名前を揃える対象はここ
- B: 年に数回引かれる — 電子化して手元に。原本は保管場所を分けてよい
- C: ほぼ引かれない — 電子化せず、そのまま外部倉庫でよい
ここで効くのは、Cが想像よりずっと多いことです。何年も触っていない箱が棚の大半を占めている、というのはよくある状態で、この一群は名前を付ける価値がありません。スキャンする対象からも外して構いません。
逆に、Aは想像よりずっと少ないのが普通です。日常的に引かれるのは直近1〜2年ぶんの取引関係の書類と、進行中の案件の書類に集中します。ここに絞れば、電子化の作業量は現実的な規模になります。
分けるときの基準は「置いてある場所」ではなく「聞かれ方」
頻度を測るのに、アクセスログのような数字はありません。代わりに使えるのが、問い合わせの言葉です。
- 「○○社の見積、最新のある?」のように固有名で聞かれるもの → A。名前で引ける状態にする価値が高い
- 「前期の分、一式ある?」のように期間で聞かれるもの → B。束で取り出せれば足りる
- そもそも聞かれた記憶が無いもの → C
この分け方には副産物があります。Aに入った書類は、何を手がかりに探されるかまで同時に分かることです。取引先名で聞かれるならファイル名の先頭は取引先、案件名で聞かれるなら案件名——後の工程で決めることが、ここで半分決まります。
どの手段を選んでも、最後に名前の問題が残る
Aの書類を電子化すると決めたあと、次に来るのがこれです。そして、ここが5つの手段のどれでも自動的には片付きません。
スキャン代行に出しても、名前は付いてこない
代行業者の標準的な納品物は、連番のPDFと、箱やバインダー単位のフォルダ分けです。1枚ずつ中身に応じた名前を付けてもらう「索引付け」はオプション扱いで、枚数に比例して費用が上がります。数万枚あるなら、ここが見積りの大半を占めることもあります。
費用を抑えるために索引付けを外すと、戻ってきたPDFは中身が分からないまま積み上がります。紙のときはインデックスシールが貼ってあったぶん、かえって探しにくくなることさえあります。
全文検索は、スキャンPDFには効かないことがある
ファイルサーバーの全文検索は、ファイルの中に文字情報が入っていることが前提です。複合機でスキャンしただけのPDFは画像しか入っていないことが多く、この状態では1件もヒットしません。
OCRをかければ文字情報は入りますが、今度は別の問題が出ます。ヒットしすぎるのです。「山田製作所」で検索すると、その社名が本文に1回でも出てくる書類が全部並びます。差出人が山田製作所の書類も、宛先が山田製作所の書類も、社名が参考として書かれているだけの書類も、区別が付きません。
探している側が欲しいのは「山田製作所から届いた請求書」であって、「山田製作所という文字列を含むファイル」ではありません。この差を埋めるのが名前です。
文書管理システムは、入力が続くかどうかで決まる
属性を登録して検索する仕組みは、正しく運用できれば最も強力です。ただし前提として、登録する人が毎回入力する必要があります。
導入が失敗するときの形はだいたい同じで、必須項目を10個決めてしまい、忙しい部署から順に入力が雑になり、半年後には空欄と「その他」だらけになります。項目を3つに絞って始められるか、そもそも入力を人にやらせずに済ませられるか——検討する軸はここです。
名前の形は「探す人が最初に思い出す語」から決める
Aの書類に付ける名前は、次の順で並べます。
[最初に思い出す語]_[書類種別]_[日付].pdf
山田製作所_見積書_20260826.pdf
山田製作所_注文書_20260901.pdf
丸の内ビル改修_施工計画書_20260710.pdf
先頭に来るのは、前の章で拾った「聞かれ方」の語です。取引先名で聞かれるなら取引先名、案件名で聞かれるなら案件名。会社全体で1つに統一する必要はありません。部署ごとに聞かれ方が違うなら、部署ごとに違って構いません。
そのうえで、共通で守ると効くものが3つあります。
- 日付は西暦8桁で末尾に — 20260826 の形。2026-8-26 のように桁が揃わないと、名前順に並べたときに崩れます
- 区切りは半角アンダースコア1種類に決める — スペース・全角アンダースコア・ハイフンが混ざると、並べ替えたときに同じ相手先が離れます
- 表記ゆれを1つに固定する — ㈱ と 株式会社 は別の文字列です。法人格は付けない、と決めてしまうのがいちばん揺れません
名前に入れないもの
- 金額 — ファイル名はメールの添付名や画面共有中の一覧にも出ます。本文を開く権限のない人の目に触れる場所です(経理の中で閉じる証憑類は例外で、その理由は証憑書類の記事にまとめています)
- 「最新」「旧」「済」などの状態 — 状態はいずれ変わります。名前に固定すると、そのうち必ず嘘になります
- 担当者名 — 担当は替わります。替わったときに全件の直しが発生します
- 保管場所(棚番号・箱番号) — 電子化した時点で、その情報は探す役に立ちません
フォルダは深くしない
名前が揃っていれば、フォルダは浅くて済みます。逆に、フォルダを深くすることで名前の弱さを補おうとすると、置き場所が2通り考えられる書類が必ず出てきて、そこで手が止まります。
階層に使ってよいのはあとから変わらないものだけです。年、拠点、部署のように動かない軸なら安全です。案件の進捗や書類の状態のように動く軸で切ると、動くたびにファイルの引っ越しが発生します。
スキャンした瞬間に名前が付く形にする
ルールを決めても、名前を打つのが人の作業である限り、忙しい週から順に抜けます。しかも抜けた分は取り返されません。名前を付け直す作業には期限が無いので、いつまでも後回しになるからです。
最近は、AI が PDF の中身を読み取ってファイル名を自動生成する方法が使えるようになりました。スキャン先のフォルダを監視しておき、保存された瞬間に「山田製作所_見積書_20260826.pdf」の形へ変換する、という仕組みです。メールで届いたPDFを同じフォルダに置けば同じ処理に乗るので、紙と電子で扱いを分ける必要がありません。
書類保管の見直しという文脈で見ると、この方法には位置づけ上の利点があります。いまのフォルダ構成のまま始められることです。全社で新しいシステムに移る必要も、登録の運用を決める必要もなく、Aに分類した書類のスキャン先を1つ決めるだけで足ります。うまくいかなければ、その入口を止めれば元に戻ります。
スキャンリーは、書類種別と命名ルールを自社で自由に登録でき、項目の並び順も指定できます。「法人格は付けない」「日付は西暦8桁で末尾」といった指示も書類種別ごとに設定でき、読み取った値を使って保存先フォルダを組み立てることもできるので、年別・取引先別の振り分けまでスキャン時点で済ませられます。
自動化できないところは、正直に書いておきます
- 紙そのものは減りません — 原本をどうするかは別の判断です。この記事では触れていない保存義務の話が絡むので、顧問にご確認ください
- A・B・Cの仕分けは自動化できません — 引かれる頻度は書面に印字されていません。ここは人が決める工程として残ります
- 書面に無い情報は名前に入れられません — 社内の案件コードや管理番号が書面に印字されていない場合、それを自動で埋めることはできません
- 権限管理はしません — 誰がどのフォルダを見られるかは、ファイルサーバー側の設定の仕事です
- 過去の大量の紙を一気に片付ける用途には向きません — 数万枚の遡及分は、スキャン代行に索引付きで出したほうが早いこともあります。日々発生する分を止めるのが本来の使いどころです
自動でできるのは、探す人が最初に思い出す語で、まっすぐ引ける状態を作るところまでです。そこから先は人が見る前提で組んでおくと、期待とのずれが出ません。
なお、外部に送る範囲が気になる場合のために書いておくと、スキャンリーが AI に送るのは PDF の先頭2ページのみで、処理は東京リージョンで完結し、送ったデータは学習に使われず処理後に破棄されます。詳細はデータの安全性についてにまとめています。
まとめ
書類保管の電子化が「紙は減ったのに探せない」で止まるのは、場所の問題として着手して、探す問題を手つかずで残したからです。順番を逆にすると、やることは一気に減ります。まず引かれる頻度で3つに分け、Aだけを対象にして、名前を揃える。手段を比べるのはそのあとです。
この記事のポイント:
- 選択肢は5つ(外部倉庫・スキャン代行・文書管理システム・全文検索・自動リネーム)あり、解く問題が違う
- 保管コストは場所代だけでなく、出庫にかかる時間まで含めて見る
- 最初にやるのは業者比較ではなく、A(月1回以上)・B(年数回)・C(ほぼ引かれない)の仕分け
- 頻度は問い合わせの言葉で測る。固有名で聞かれる=A、期間で聞かれる=B
- スキャン代行の標準納品は連番。索引付けは枚数比例のオプション費用になる
- 全文検索はスキャンPDFに効かないことがあり、OCR後は逆にヒットしすぎる
- 名前は「探す人が最初に思い出す語_書類種別_西暦8桁」。統一は部署単位で足りる
- 金額・状態・担当者名・棚番号は名前に入れない。フォルダは動かない軸だけで切る
スキャンしたPDFが探せない状態そのものについては、「スキャンしたPDFが見つからない」を解決するファイル整理術で詳しく扱っています。総務部門での探し方は総務部のスキャン書類が「担当者しか探せない」を直す方法を、読み取った値でフォルダを振り分ける方法は書類の種類ごとにフォルダを自動で振り分けるをご覧ください。