AI-OCRと自動仕訳を会計事務所に入れる7判断軸と精度検証

AI-OCRと自動仕訳を会計事務所へ導入するときの7つの判断軸、4週間の精度検証の設計、電子帳簿保存法と守秘義務の論点を実務の手順として整理します。

AI-OCRと自動仕訳を会計事務所に入れる7判断軸と精度検証

AI-OCRとは、請求書などの画像から文字と項目を読み取る仕組みのことです。

記帳代行の1件あたりに、いま何分かけているでしょうか。この記事では、AI-OCRと自動仕訳を会計事務所に導入するときの7つの判断軸と、精度をどう検証して受け入れ基準を決めるか、そして電子帳簿保存法との関係で押さえておく論点を整理します。本記事は士業のチカラ編集部が、公表されている一次情報のみを根拠に作成しています。法令の条文はe-Gov法令検索の原文で、行政の見解は各府省庁の公表資料で確認しています。

精度の議論は、読み取りと仕訳を分けないと噛み合わない

結論から書くと、AI-OCRと自動仕訳は別の工程であり、精度の測り方も違います。ここを分けずに評価すると、どこで間違えているのかが分からないまま導入判断をすることになります。

読み取りの工程では、画像から日付・取引先・金額・税率といった項目を取り出します。ここでの誤りは、文字の読み違いと、項目の取り違えの2種類です。金額の桁を読み違えるのが前者、備考欄の数字を金額として拾うのが後者です。前者は見れば分かりますが、後者は数値として妥当に見えるため気づきにくく、事故になりやすい誤りです。

仕訳の工程では、読み取った項目から勘定科目と税区分を決めます。ここでの誤りは、科目の誤りと、税区分の誤りに分かれます。科目の誤りは月次の内訳で気づけますが、税区分の誤りは申告の段階まで表面化しないことがあります。インボイス制度の経過措置のように控除割合が段階的に変わる局面では、税区分の設定が結果に直結します。経過措置の内容はインボイス経過措置は50%ではなく70% 10月改正を顧問先に説明する6工程で整理しています。

したがって、精度を語るときは4つに分けます。文字の読み取り、項目の割り当て、勘定科目、税区分。ベンダーが示す認識率は多くの場合1つ目の指標であって、事務所が本当に知りたい3つ目と4つ目の精度とは別物です。この区別を持たずに比較すると、数字の大きいほうを選んで後で困ることになります。

導入前に見る7つの判断軸

第1の軸は、精度をどの粒度で開示しているかです。総合の認識率だけを示す製品と、項目別の精度を示す製品では、検証のしやすさが違います。項目別に出せない場合は、自事務所で測る前提で評価します。

第2の軸は、学習の方式です。事務所ごとの修正内容を反映して精度が上がる仕組みか、固定のモデルで動くかで、運用初期の負担が変わります。学習する方式は最初が重く後が軽く、固定の方式はその逆になります。どちらを選ぶかは、顧問先の書式のばらつきの大きさで決まります。

第3の軸は、確信度の表示です。読み取り結果に対して、機械側がどれだけ確からしいと判断しているかが示されるかを見ます。確信度が出れば、低いものだけを人が見る運用が組めます。出ない場合は全件確認になり、削減効果が大きく下がります。

第4の軸は、修正の記録です。誰がいつ何を直したかが残るかを確認します。この記録は、後述する電子帳簿保存法の要件との関係でも、事務所の内部統制の観点でも要になります。権限と記録の設計の考え方は記帳を担うAIエージェントの権限をどう分けるか 会計事務所の内部統制7設計で整理しています。

第5の軸は、会計システムとの接続です。仕訳データの受け渡しがAPIで完結するか、書き出しと取り込みを人が行うかで、工数が変わります。取り込みが手作業だと、読み取りが速くなっても全体の時間は思ったほど減りません。

第6の軸は、データの保管場所です。顧問先の証憑画像がどの事業者の管理下に置かれるかを確認します。ここは守秘義務の整理に直結する事項で、後述します。

第7の軸は、撤退のしやすさです。過去に読み取った画像とデータを、契約終了時に引き出せるかを見ます。証憑は保存期間が長いため、引き出せない設計だと乗り換えが実質できなくなります。

精度検証を4週間で設計する

検証は、実際の顧問先の書類で行います。ベンダーの提供するサンプルでの精度は、自事務所の書式では再現しません。

第1週は、対象の選定です。顧問先を3社選びます(根拠は、書式のばらつきを見るには複数社が要る一方、母数を増やすと検証自体が回らなくなるためです)。選ぶ基準は、書式がばらついている社、件数が多い社、税区分が複雑な社の3つです。うまくいきそうな社ばかり選ぶと、検証の意味がなくなります。

第2週は、読み取りの検証です(根拠は、仕訳の精度を測る前に入力側の誤りを切り分ける必要があるためです)。対象社の証憑を読み取らせ、日付・取引先・金額・税率の4項目について、正誤を1件ずつ記録します。ここで重要なのは、誤りの種類を分けて記録することです。文字の読み違いと項目の取り違えを別欄にすると、後で対策が変わります。

第3週は、仕訳の検証です。読み取り結果から生成された仕訳について、勘定科目と税区分の正誤を記録します。同時に、修正にかかった時間も記録します。精度が高くても修正の操作が面倒であれば、実務では時間が減りません。

第4週は、受け入れ基準の決定です。検証結果を見て、どの水準を満たせば人の全件確認を外すかを決めます。基準は項目ごとに変えて構いません。金額は全件確認を維持し、取引先名は確信度が高いものを確認対象から外す、といった設計が現実的です。

検証を通したあとの運用手順は5つです。第1に、読み取り結果を確信度で仕分けます。第2に、確信度が低いものと、金額が一定額以上のものを人の確認に回します。第3に、仕訳の生成後、勘定科目と税区分を担当者が確認します。第4に、月次の締めの段階で、有資格者が全体の妥当性を確認します。第5に、修正の内容を分類して記録し、翌月の基準見直しに使います。

検証と運用を補助させるプロンプト例を2本示します。1本目は、誤りの分類です。

あなたは会計事務所の検証補助です。以下の読み取り誤りの記録を、
4分類に仕分けてください。記載された情報だけで判断し、推測しないでください。

分類:
A 文字の読み違い(数字・文字の誤認識)
B 項目の取り違え(別の欄の値を拾った)
C 勘定科目の誤り
D 税区分の誤り

出力形式: 通番 / 分類 / 判断の根拠となった記載 / 人の目で気づけるか(易・中・難)
「気づけるか」が難のものだけを、出力の最後にまとめて再掲してください。

2本目は、受け入れ基準の草案づくりです。

以下の検証結果から、項目ごとの受け入れ基準の案を3通り作ってください。
案ごとに、全件確認を外す項目と、確認を維持する項目を明示してください。

入力: 項目名 / 検証件数 / 誤りの件数 / 誤りの分類内訳 / 修正の平均所要時間

各案について次を示してください。
1. 想定される確認工数の増減
2. 見逃した場合に申告まで表面化しない誤りが含まれるか
3. その案を採るときに必要な追加の統制

どの案を採るかは有資格者が判断するため、推奨や結論は書かないでください。

いずれの工程でも、月次の締めで有資格者が全体の妥当性を確認する工程は残します。機械の確信度が高いことと、その仕訳が顧問先の実態に合っていることは別の話だからです。

事務所規模ごとの進め方

1人から3人規模であれば、対象を1社に絞って4週間回すのが現実的です(根拠は、検証の記録作業が通常業務と同じ担当者に集中するためです)。検証そのものが稼働を圧迫するため、件数の多い顧問先1社で基準を作り、翌月から2社目に広げる刻み方にします。

5人から10人規模であれば、3社での検証を担当者2人で分担できます(根拠は、記録作業を分けても分類定義を揃えれば比較可能なためです)。分担する場合は、誤りの分類の判断基準を先に揃えておかないと、記録が比較できなくなります。分類の定義を1枚にまとめてから始めます。

10人を超える規模であれば、顧問先を業種で分けて検証する価値が出ます(根拠は、業種ごとに証憑の書式と勘定科目の傾向が異なるためです)。建設業と小売業では証憑の書式も勘定科目の傾向も異なるため、業種別に受け入れ基準を分ける設計が効きます。

検証で使う記録表の形

記録表の列は7つで足ります。通番、顧問先、証憑の種類、項目名、機械の出力、正しい値、誤りの分類です。ここに修正にかかった時間の列を足すと、精度と工数を同じ表で見られるようになります。表計算ソフトで作り、検証期間中は担当者が手元で埋め、週末に集計する運用が続きやすい形です。

集計で見るのは3つです。項目別の誤り率、誤りの分類の内訳、そして人の目で気づきにくい誤りの件数。3つ目が最も重要で、ここが多い製品は、認識率が高くても事務所のリスクは下がりません。気づきにくい誤りとは、数値として妥当に見えるが実際は別の欄から拾った値、といった種類のものです。

集計結果は、そのまま受け入れ基準の根拠になります。ベンダーの説明ではなく自事務所の数字で基準を決めた事務所は、後から顧問先や監査対応で説明を求められたときに、根拠を示せます。

証憑画像と電子帳簿保存法の論点

AI-OCRの導入では、証憑をスキャンして保存する運用と一体で検討することになります。ここで参照するのが、国税庁が公表している電子帳簿保存法一問一答【スキャナ保存関係】です。スキャナ保存の要件や、実務上の疑問への回答がまとめられています。事務所として参照先を1つに固定し、版が更新されたら差し替える運用にします。

規程の整備については、国税庁が参考資料(各種規程等のサンプル)を公表しています。事務処理規程の雛形が示されているため、AI-OCRを組み込んだ運用に合わせて追記する形が取りやすくなります。追記する内容は、読み取り結果の確認者、修正の記録の残し方、確認を省略する条件の3点が中心になります。

守秘義務の側の論点も同時に整理します。税理士法第38条は、正当な理由がなくて税理士業務に関して知り得た秘密を他に洩らし、または窃用してはならないと定めています。公認会計士法第27条にも、同趣旨の規定が置かれています。証憑画像は顧問先の取引情報そのものであり、どの事業者のサーバーに保管されるかを把握したうえで、顧問契約の中で外部サービスの利用範囲をどう伝えるかを決めておく論点になります。

個人情報を含む証憑の扱いについては、個人情報保護委員会が生成AIの利用に関する注意喚起を公表しています。従業員の氏名や口座情報が含まれる書類をどう扱うかは、事務所として先に方針を決めておくと、案件ごとに迷わずに済みます。

事務所規程に落とす項目は5つです。第1に、読み取りに回してよい証憑の範囲。第2に、確認を省略できる条件。第3に、修正記録の保存期間。第4に、保管場所と契約終了時のデータの扱い。第5に、月次の締めで誰が全体を確認するかです。この5項目を、既存の事務処理規程とAI利用規程の両方に矛盾なく書けるかを確認します。

導入でつまずく3つの場面

1つ目の場面は、認識率の数字だけで製品を選ぶことです。総合の認識率が高くても、税区分の判定が弱ければ、申告の段階で手戻りが出ます。本文で示した4分類で精度を見る設計にしておけば、この選び方は避けられます(根拠は、税区分の精度が総合認識率に埋もれるためです)。

2つ目の場面は、確信度の低い読み取りを見逃すことです。確信度の表示がある製品でも、しきい値の設定を初期値のままにしていると、事務所の実態に合いません。運用開始から数か月は、しきい値を下げた状態で始めて、記録を見ながら上げていく順序が向いています。

3つ目の場面は、修正が記録に残らない運用になることです。担当者が画面上で直して終わりにすると、何をどれだけ直したかが分からず、受け入れ基準の見直しができません。修正の記録は、精度改善のための材料であると同時に、事後の説明のための資料でもあります。

共通する対策は、記録の設計を導入前に決めておくことです。誤りの分類、修正者、修正時刻、修正前後の値。この4つが残る形にしてから運用を始めると、あとから振り返れます。

費用と工数 誰が基準を見直すか

費用面では、AI-OCRの料金体系は読み取り件数に連動する形が主流です。記帳代行の件数が多い事務所ほど、月額が積み上がります。判断の材料としては、件数あたりの単価と、削減できる作業時間の人件費換算を並べて比較する形になります。会計システムの上位プランが前提になる製品もあるため、そのプラン差額も費用に含めます。

工数の目安として、4週間の精度検証にかかる追加の稼働は、担当者1人で合計20時間程度です(根拠は、1件ごとの正誤記録と分類が作業の中心を占め、対象社数と件数に比例するためです)。この20時間を省いて導入すると、受け入れ基準が根拠のないまま決まります。

体制としては、精度記録の管理者を1人置き、月次で誤りの分類の傾向を見る役割を持たせる形が扱いやすい形です(根拠は、記録の一貫性が複数人での運用では崩れやすいためです)。基準の見直しは四半期に一度、有資格者を含めて行います。事務所全体でAI活用を段階的に進める順序はまだ生成AIを使っていない会計事務所へ 12か月の移行ロードマップの考え方と揃えられます。

初月の進め方を絞るなら、読み取りだけを回して仕訳は従来どおり人が作る形から始めます。読み取りの精度が安定しないまま仕訳の自動生成まで進めると、誤りの原因が入力側か判定側かの切り分けができません。読み取りが安定してから仕訳へ進む順序にすると、検証の記録がそのまま次の工程の材料になります。

所内の説明では、AI-OCRが何をするかより、担当者の役割がどう変わるかを伝えるほうが効きます。入力する人から、確認して判断する人へ役割が移る。この変化を先に共有しておかないと、確認が形式的な作業になり、精度の記録も雑になります。役割の変化を評価にどう反映するかも、あわせて検討する事項です。

読み取りが当たり前になった先に残る仕事

読み取りと仕訳の自動化が進むと、記帳代行の作業そのものは薄くなります。そのとき事務所に残るのは、判断と説明の部分です。どの取引をどう処理するかの判断、顧問先への説明、そして数字から経営の状況を読み取る作業がこれにあたります。

もう1つの論点は、顧問先が自社で読み取りまで完結させる場合の関与の形です。顧問先側でAI-OCRを動かし、事務所は結果の確認と判断を担う分業が広がると、事務所の作業量と報酬の関係が変わります。関与の設計を先に見直しておくかどうかで、数年後の収益構造が変わります。

3つ目は、記録の価値です。誤りの分類と修正の記録を積み上げた事務所は、どの業種のどの書式で何が起きやすいかを把握できます。この蓄積は他所から買えないため、事務所の資産になります。導入初期の記録の手間は、そう考えると投資に近い性質を持ちます。

よくある質問

認識率が高い製品を選べばよいですか

認識率だけでは判断できません。多くの場合、示されているのは文字の読み取りの精度であり、勘定科目や税区分の判定精度とは別の指標だからです。文字の読み取り、項目の割り当て、勘定科目、税区分の4つに分けて、自事務所の証憑で測る手順が必要になります。

精度検証はどのくらいの期間が要りますか

4週間が現実的な出発点です。書式のばらつきを見るために顧問先を複数社選び、読み取りと仕訳を別の週に分けて検証し、最後に受け入れ基準を決める流れになります。期間を短くすると、税区分のように件数の少ない誤りが検出できません。

人の確認を全件から減らしてよいのはいつですか

受け入れ基準を項目ごとに決めたあとです。金額のように誤りが直接影響する項目は全件確認を維持し、確信度が高く誤りの少ない項目から順に外していく設計が採られています。判断は検証記録に基づいて行い、記録がない段階では外さない形にします。

顧問先の証憑画像を外部サービスに置いてよいですか

保管場所と契約内容によって変わるため、導入前に整理する論点になります。守秘義務の根拠は税理士法第38条に置かれており、どの事業者の管理下に置かれるかを把握したうえで、顧問先への説明範囲とあわせて決める手順が現実的です。

電子帳簿保存法の要件はどこで確認しますか

国税庁が公表している電子帳簿保存法一問一答【スキャナ保存関係】が一次情報になります。版が更新されるため、事務所として参照している版を明示し、更新時に差し替える運用にします。

修正の記録はどこまで残しますか

誤りの分類、修正者、修正時刻、修正前後の値の4つを残す形が扱いやすい構成です。精度改善のための材料としても、事後の説明のための資料としても使えます。保存期間は既存の事務処理規程に合わせると、運用が二重になりません。

学習する製品と固定の製品はどちらがよいですか

顧問先の書式のばらつきで決まります。書式が多様な事務所では、修正内容を反映して精度が上がる方式の効果が大きくなります。書式が揃っている場合は、初期から安定して動く固定の方式のほうが導入が軽く済みます。

参考文献

※士業のチカラでは、生成AIの導入支援から運用最適化まで、貴事務所の業務に合わせたカスタマイズ提案を行っています。無料相談(30分)も実施中ですので、お気軽にお問い合わせください。
https://shigyonochikara.jp/contact/

本記事の作成体制について

本記事は士業のチカラ編集部が、公表されている一次情報のみを根拠に作成しています。法令の条文はe-Gov法令検索の原文で、行政の見解は各府省庁の公表資料で、それぞれ確認したうえで記載しています。引用元は本文中および参考文献にすべて明示しています。

本記事には特定の資格者による監修は入っていません。個別の事案について法令の当てはめや手続の可否を判断する必要がある場合は、当該分野の有資格者にご相談ください。本記事は一般的な情報提供を目的としたものであり、個別具体的な法律判断・税務判断・労務判断を提供するものではありません。

記載内容に誤りを見つけられた場合は、お問い合わせよりご指摘ください。確認のうえ速やかに訂正し、訂正履歴を記事内に残します。編集方針の詳細は運営者情報をご覧ください。