生成AIモデル選定とは、士業事務所が業務内容に応じてAIモデルを使い分ける判断のことです。
契約書のドラフト1本にどのモデルを使うかで、月間のAI費用は数倍変わります。この記事では、Claude Opus 5・GPT-5.6・Gemini 3.7という主要3モデルを、士業事務所がどう使い分けるべきかを3つの判断軸で整理します。本記事は士業のチカラ編集部が、公表されている一次情報のみを根拠に作成しています。法令の条文はe-Gov法令検索の原文で、行政の見解は各府省庁の公表資料で確認しています。Anthropic公式のAPI料金表によれば、Claude Opus 5は入力100万トークンあたり5ドル・出力100万トークンあたり25ドルで提供されています(Claude API Pricing)。
AIモデル選定を取り巻く2026年9月の状況
生成AIベンダー各社のモデル改定は年に数回のペースで続いており、士業事務所がどのモデルを標準として使うかを固定しづらい状況が続いています。Anthropicの公式料金表では、Claude Opus 5は入力5ドル・出力25ドル(100万トークンあたり)で提供され続けている一方、上位のClaude Opus 5.5は入力4ドル・出力20ドルとより低価格で提供されています(Claude API Pricing)。OpenAIの公式ドキュメントでは、GPT-5.6の標準版(Sol)は短文脈で入力4ドル・出力20ドル、長文脈(コンテキストが大きい入力)では入力8ドル・出力30ドルとなっており、上位版のGPT-5.6 Cyberは短文脈のみで入力12.5ドル・出力75ドルと高価格帯です(OpenAI API Pricing)。Googleの公式ドキュメントでは、Gemini 3.1 Pro Previewが入力2ドル・出力12ドル(プロンプト20万トークン以下の場合)、廉価版のGemini 3.7 Flashは2026年12月31日まで入力0.75ドル・出力3.75ドルの時限価格で提供されています(Gemini API Pricing)。士業事務所にとっての論点は、性能の優劣そのものより、どの業務にどの価格帯のモデルを充てるかという配分の設計です。
こうした価格帯の広がりは、2025年から続くベンダー各社の価格競争を反映したものです。Gemini 3.7 Flashのように2026年12月31日までの時限価格を設定する例もあり、士業事務所が費用試算を一度作って終わりにするのではなく、半期ごとに見直す前提で運用を設計しておく必要があります(Gemini API Pricing)。
事務所内でモデルを使い分ける3つの判断軸
事務所でモデルを使い分ける際は、次の3つの軸で整理すると実務に落とし込みやすくなります。
第一の軸は、成果物の重要度です。契約書レビューや意見書のドラフトなど、有資格者の最終判断が前提でも誤りの影響が大きい業務には、Claude Opus 5やGPT-5.6 Sol、Gemini 3.1 Pro Previewのような上位モデルを充てます。逆に、議事録の要約や定型メールの下書きなど、誤りがあってもすぐに気づける業務には、Gemini 3.7 FlashやGPT-5.6のような廉価モデルを充てる設計です。
5人規模・月120件程度の問い合わせ対応を想定する税理士事務所(出典: 本記事編集部による仮定の試算例、実数値ではありません)を例にすると、これらをGemini 3.7 Flashのような廉価モデルに任せ、申告書のチェック前段階の要点整理のような重要度の高い業務だけをClaude Opus 5やGPT-5.6 Solに残す、という配分が現実的な出発点になります。
第二の軸は、入力する文書の分量です。相談履歴や過去の契約書を大量に読み込ませて要約させる場合、長文脈を扱うモデルの方がコスト効率が良くなる場面があります。GPT-5.6 Solは長文脈になると単価が入力8ドル・出力30ドルへ上がる一方、短い入力を大量にさばく定型業務では短文脈の単価(入力4ドル・出力20ドル)で足りるため、業務ごとに文脈量を見積もっておくことが費用管理の起点になります(OpenAI API Pricing)。
第三の軸は、事務所内の運用体制です。複数のモデルを併用すると、職員ごとにどの業務でどのモデルを使うかがばらつきやすくなります。次の手順で運用を整理する事務所が増えています。
- 業務を「重要度・高/低」「文脈量・多/少」で4象限に分類する
- 各象限に使用するモデルを1つずつ割り当てる(例: 重要度高・文脈量少→Claude Opus 5、重要度低・文脈量少→Gemini 3.7 Flash)
- 割り当て表を事務所内の運用ルールとして共有し、月次で利用実績を確認する
- 成果物は有資格者が最終確認する工程を組み込み、AIの出力をそのまま依頼者・顧問先に提示しない
ChatGPT・Claude・Geminiで使えるプロンプト例を示します。
あなたは契約書レビューの下読み担当です。以下の契約書(架空のA社とB社間の業務委託契約書)について、
①危険条項の候補を3つまで、②その条項がなぜ論点になり得るかを1文で、③確認すべき事実関係を箇条書きで
出力してください。最終的な法的判断は行わず、確認候補の提示に留めてください。
以下は事務所内の相談記録(架空の事例)の要約対象テキストです。相談者名・固有名詞は「相談者」「甲」等に
置き換えたうえで、①相談の要旨、②これまでの対応状況、③次回までに確認すべき事項、の3項目で
300字程度に要約してください。
顧問先資料をAIに入れる前に決めておく守秘義務の論点
士業事務所がどのモデルを選んでも、顧問先・依頼者から預かった情報をAIに入力する行為そのものは、各士業法上の守秘義務の対象になり得ます。弁護士は弁護士法第23条、税理士は税理士法第38条、社会保険労務士は社会保険労務士法第21条、弁理士は弁理士法第30条で、それぞれ業務上知り得た秘密を漏らしてはならない旨が定められています(e-Gov法令検索 弁護士法第23条、e-Gov法令検索 税理士法第38条、e-Gov法令検索 社会保険労務士法第21条、e-Gov法令検索 弁理士法第30条)。
AnthropicはAPIを通じて送信されたデータについて、既定では学習に利用しない方針を公式ドキュメントで示しており、OpenAI・Googleも法人向けAPIでは同様に既定で学習非利用とする方針を公表しています。ただし、これはAPI経由の利用に関する各社の方針であり、無料版や個人向けチャット画面経由での利用条件は別枠で確認しておく点がポイントです。事務所として利用する際は、契約しているプランがAPI経由か個人向けプランかを確認し、顧問先に説明できる状態にしておくことが実務的な対応になります。
職種によって守秘義務の根拠条文は異なりますが、いずれも業務上知り得た秘密を対象にしている点は共通しており、モデルの種類やコスト帯にかかわらず、顧問先の固有情報を入力する場面では同じ水準の注意が必要になります。
顧問先への説明では、①どのモデルにどの範囲の情報を入力するか、②入力前に固有名詞をどう匿名化するか、③異議が出た場合にAIを使わない方式へ切り替えられるか、の3点を伝えておくと同意取得のプロセスとして整理しやすくなります。事務所規程に落とし込む際は、モデルごとの利用範囲(重要度・文脈量の4象限表)と、入力前の匿名化手順を明文化する運用例が考えられます。これらは規範として断定するものではなく、各事務所の実情に応じて調整する前提のものです。
モデル使い分けでの失敗例と回避策
一つ目の失敗例は、廉価モデルに重要度の高い契約書レビューを任せてしまい、有資格者の確認工程が形骸化するケースです。価格差だけでモデルを選ぶと、成果物の重要度という軸が抜け落ちがちです。回避策は、先述の4象限表を事務所内で固定し、価格変動があっても重要度の高い業務には上位モデルを割り当て続けるルールを維持することです。
二つ目の失敗例は、長文脈の入力を短文脈向けの単価で見積もってしまい、想定外の請求額になるケースです。GPT-5.6 Solのように文脈量で単価が変わるモデルでは、入力する文書の分量を事前に見積もらずに使い始めると、月末の請求で気づくことになります。回避策は、代表的な業務について事前に1回分の入力トークン数を試算し、単価表と突き合わせておくことです。
三つ目の失敗例は、複数モデルを併用した結果、どの職員がどのモデルにどの情報を入力したかが追えなくなるケースです。回避策は、利用ログを月次で棚卸しする担当者を決め、割り当て表からの逸脱がないかを確認する仕組みを運用に組み込むことです。
四つ目の失敗例は、時限価格が終了した後もモデルの割り当てを見直さず、想定より高い単価のまま運用を続けてしまうケースです。Gemini 3.7 Flashのように終了日が明示されている価格改定については、その前後で4象限表と費用試算を更新する運用にしておくことが回避策になります。
導入にかかる費用と体制
モデルの利用料金は前述のとおり、Claude Opus 5が入力5ドル・出力25ドル、GPT-5.6 Sol短文脈が入力4ドル・出力20ドル、Gemini 3.7 Flashが入力0.75ドル・出力3.75ドル(いずれも100万トークンあたり、2026年12月31日までの価格)と、モデル間で数倍から十数倍の開きがあります(Claude API Pricing、OpenAI API Pricing、Gemini API Pricing)。初期構築としては、4象限表の作成と職員への周知に、小規模な事務所であれば数日程度を見込んでおくと現実的です。運用の主担当は、AI活用を日常的に主導するパートナーかシニアスタッフが持ち、月次で利用実績とログを確認する棚卸しの機会を設けると、割り当て表の形骸化を防ぎやすくなります。
費用感の目安として、月に文書要約や下書き作成で入力・出力あわせて100万トークン程度を消費する事務所を想定すると、Gemini 3.7 Flashであれば数百円から数千円程度、Claude Opus 5やGPT-5.6 Solであれば数千円から1万円台になる計算です(出典: 前掲Claude API Pricing・OpenAI API Pricingの単価から編集部試算。実際の消費トークン数は業務量により変動するため、事務所ごとに実績値で試算し直すことが前提になります)。上位モデルと廉価モデルを併用する設計にしておけば、重要度の高い業務にコストを集中させつつ、全体の費用を抑えやすくなります。
今後の展望と考察
各社のモデル改定サイクルは今後も続くと見込まれ、事務所が特定のモデル名に依存した運用ルールを作ると、改定のたびにルールを書き直すコストが発生します。重要度と文脈量という2つの軸で業務を分類する運用にしておけば、モデル名が変わっても割り当て表の枠組み自体は維持しやすくなる、という点が論点になります。また、Gemini 3.7 Flashのような廉価モデルの時限価格(2026年12月31日まで、出典: 前掲Gemini API Pricing)が終了した後の価格改定が、事務所の費用構造にどう影響するかも今後の確認事項です。事務所としては、特定モデルの価格に依存した費用計画を立てるのではなく、重要度・文脈量という業務区分の枠組みを先に固定し、その区分に充てるモデルを半期ごとに見直す運用にしておくことが、価格改定のたびに費用計画を作り直す手間を減らす論点になります。
よくある質問
複数のAIモデルを契約する必要がありますか
1モデルに絞る必要はなく、重要度と文脈量に応じて複数モデルを使い分ける事務所が増えています。ただし、契約数が増えるほど運用ルールの管理が複雑になるため、まずは2モデル程度から始める事務所が多いです。
廉価モデルを使うと成果物の質が下がりますか
用途によります。議事録要約や定型メールの下書きのような業務では廉価モデルでも実務上十分なケースが多く、契約書レビューのような重要度の高い業務では上位モデルとの差が出やすいとされています。事務所ごとに実際の成果物を比較したうえで判断することが実務的です。
モデルの利用料金は誰が負担するのが一般的ですか
事務所の経費として処理するケースが一般的ですが、案件ごとの原価に組み込むかどうかは事務所の会計方針によって異なります。いずれの場合も、月次の利用実績を確認できる体制にしておくことが前提になります。
AIに入力した内容がモデルの学習に使われることはありますか
各社ともAPI経由の利用については既定で学習に利用しない方針を公式ドキュメントで示していますが、個人向けチャット画面など利用形態によって条件が異なる場合があるため、契約しているプランの利用条件を個別に確認しておくことが実務的な対応になります。
モデルを切り替えるタイミングの目安はありますか
価格改定や新モデルの発表があったタイミングで、既存の4象限表を見直す事務所が多いです。Gemini 3.7 Flashの時限価格のように終了日が明示されている場合は、その前後で費用試算を更新しておくと切り替えの判断がしやすくなります。
事務所規模が小さくても複数モデルの使い分けは必要ですか
事務所規模にかかわらず、重要度の高い業務と低い業務が混在している限り、使い分けの発想自体は有効です。ただし小規模な事務所では運用ルールの管理コストが相対的に重くなるため、まずは1〜2業務に絞って試験導入する進め方が現実的です。
事務所の規程にモデル名を明記した方がよいですか
モデル名を規程に固定すると、改定のたびに規程の書き直しが必要になります。重要度と文脈量という2つの軸で業務区分を定義し、区分ごとに使用するモデルは別紙や運用マニュアルで随時更新する形にしておくと、規程本体を頻繁に改定せずに済みます。
参考文献
- Claude API Pricing(Anthropic公式ドキュメント)
- OpenAI API Pricing(OpenAI公式ドキュメント)
- Gemini API Pricing(Google公式ドキュメント)
- e-Gov法令検索 弁護士法第23条
- e-Gov法令検索 税理士法第38条
- e-Gov法令検索 社会保険労務士法第21条
- e-Gov法令検索 弁理士法第30条
事務所内でのモデル使い分けの費用感についてはClaude Opus 5.5が価格2割減で登場、士業のツール選定3論点、GPT-5.6の業務別の使い分けについてはGPT-5.6のSol・Terra・Luna、士業の業務別に使い分ける7つの基準、タスク単価の考え方についてはAIの費用はトークン単価では測れない|Opus 5.5のタスク単価3つの軸も参考にしてください。
※士業のチカラでは、生成AIの導入支援から運用最適化まで、貴事務所の業務に合わせたカスタマイズ提案を行っています。無料相談(30分)も実施中ですので、お気軽にお問い合わせください。
https://shigyonochikara.jp/contact/
本記事の作成体制について
本記事は士業のチカラ編集部が、公表されている一次情報のみを根拠に作成しています。法令の条文はe-Gov法令検索の原文で、行政の見解は各府省庁の公表資料で、それぞれ確認したうえで記載しています。引用元は本文中および参考文献にすべて明示しています。
本記事には特定の資格者による監修は入っていません。個別の事案について法令の当てはめや手続の可否を判断する必要がある場合は、当該分野の有資格者にご相談ください。本記事は一般的な情報提供を目的としたものであり、個別具体的な法律判断・税務判断・労務判断を提供するものではありません。
記載内容に誤りを見つけられた場合は、お問い合わせよりご指摘ください。確認のうえ速やかに訂正し、訂正履歴を記事内に残します。編集方針の詳細は運営者情報をご覧ください。