Claude Fable 5.1とMythos 5.1登場 士業事務所のモデル更新3判断軸

Claude Fable 5.1とMythos 5.1の発表内容を、士業事務所がモデル更新を判断するコスト・精度・利用範囲の3軸で整理します。

Claude Fable 5.1とMythos 5.1登場 士業事務所のモデル更新3判断軸

Claude Fable 5.1とは、Anthropicが2026年9月に発表した標準モデルの更新版のことです。

Anthropicは2026年9月、Claude Fable 5.1とClaude Mythos 5.1を発表しました(Introducing Claude Fable 5.1 and Claude Mythos 5.1)。この記事では、既存モデルからの更新を検討する士業事務所が押さえておくべき3つの判断軸(コスト・精度・利用範囲)を整理します。本記事は士業のチカラ編集部が、公表されている一次情報のみを根拠に作成しています。法令の条文はe-Gov法令検索の原文で、行政の見解は各府省庁の公表資料で確認しています。Anthropicの公式発表によれば、Fable 5.1は典型的な業務で旧モデルのFable 5と比べて約25%のコスト削減になるとされています(Introducing Claude Fable 5.1 and Claude Mythos 5.1)。

Fable 5.1・Mythos 5.1の発表を取り巻く2026年9月の状況

Anthropicの公式発表によれば、Fable 5.1とMythos 5.1は同一のモデルをベースにしながら、安全装置のレベルが異なる2つの提供形態です。Fable 5.1は一般ユーザー向けに提供される一方、Mythos 5.1は信頼できるアクセスプログラムに参加する専門家向けにのみ提供され、サイバーセキュリティや生命科学分野で強化された機能を持つとされています(Introducing Claude Fable 5.1 and Claude Mythos 5.1)。士業事務所の実務にとって直接関係するのは、原則としてFable 5.1の方です。Mythos 5.1は主にサイバーセキュリティや生命科学分野の専門家向けに設計されており、契約書レビューや税務相談、労務相談といった一般的な士業業務での利用を想定した提供形態ではありません。性能面では、コーディング関連のベンチマークであるTerminal-Bench 4.0でFable 5.1が55.8%、旧モデルのFable 5が42.0%とされ、複数分野にまたがる推論のベンチマークではツールなしの条件でFable 5.1が60.9%、旧モデルが57.8%とされています(同発表資料)。価格面では、典型的な業務で約25%、複雑なコーディング作業では最大約45%のコスト削減になるとされ、キャッシュ読み取りのコストも75%削減され100万トークンあたり0.25ドルになったと公表されています(同発表資料)。

士業事務所にとって、キャッシュ読み取りコストの削減は見落とされがちですが、同じ契約書のひな形や過去の相談記録を繰り返し参照しながら複数の質問を投げるような使い方をしている事務所では、繰り返し参照する部分がキャッシュされることで、体感以上にコストが下がる可能性があります。実際の削減幅は事務所ごとの使い方によって変わるため、更新前後で請求額を比較して確認することが前提になります。契約書のひな形集や過去の申告実務のQ&A集のように、事務所内で繰り返し参照する定型的な資料をキャッシュ対象として意識的に使う運用にしておくと、削減効果をより引き出しやすくなります。

モデル更新を判断する3つの軸

事務所がFable 5からFable 5.1への更新を検討する際は、次の3つの軸で整理すると判断しやすくなります。

第一の軸はコストです。Anthropicの発表どおり、典型的な業務では約25%、複雑なコーディング作業では最大約45%のコスト削減が見込めるとされています(Introducing Claude Fable 5.1 and Claude Mythos 5.1)。事務所で契約書レビューや長文の資料要約のような重めの処理を日常的に行っている場合、更新によるコスト削減効果は相対的に大きくなりやすいと考えられます。5人規模(出典: 本記事編集部による仮定の試算例、実数値ではありません)の税理士法人で、月次の申告関連資料の要約に日常的にAIを使っている事務所を例にすると、約25%のコスト削減が実現すれば、年間のAI関連費用の見直しにつながる規模になり得ます。

第二の軸は精度です。Terminal-Bench 4.0のようなコーディング系ベンチマークでの向上幅(42.0%から55.8%)は、プログラムのコードを直接扱わない士業事務所にとっては間接的な参考情報にとどまりますが、複数分野にまたがる推論のベンチマークでの向上(57.8%から60.9%)は、契約書の論点整理や資料の要約のような業務にも一定程度関係し得る指標です(同発表資料)。ベンチマークの数値はあくまで公表された試験条件下での結果であり、事務所が実際に扱う業務での精度向上を保証するものではない点は踏まえておきたいところです。

第三の軸は利用範囲です。Mythos 5.1は信頼できるアクセスプログラムに参加する専門家向けの提供に限定されており、一般の事務所が通常の契約で利用できるのはFable 5.1です(同発表資料)。サイバーセキュリティ関連の高度な機能に関心がある事務所であっても、Mythos 5.1へのアクセスは通常のEnterprise契約とは別の申請プロセスが必要になる可能性がある点を踏まえ、まずはFable 5.1の範囲で更新を検討するのが現実的な出発点です。

更新を判断する手順は次のとおりです。

  1. 現在契約しているプランがFable 5からFable 5.1へ自動的に切り替わるか、契約変更が必要かをベンダーまたは契約窓口に確認する
  2. 事務所内で日常的に行っている業務のうち、コスト削減効果が大きいと見込まれる業務(長文処理・重い処理が多い業務)を洗い出す
  3. 洗い出した業務の中から複数件を選び、旧モデルと新モデルの両方で同じ入力を試し、出力を並べて比較する
  4. 比較結果を有資格者が確認し、精度・表現の妥当性に問題がないかを判断する
  5. 問題がなければ本格運用へ移行し、コスト削減効果を月次の請求額で確認する
  6. 移行後1〜2か月は請求額と出力品質の両方を通常より高い頻度で確認し、問題があれば旧モデルへの切り戻しを検討する

ChatGPT・Claude・Geminiで使えるプロンプト例を示します。

以下は事務所で日常的に行っている業務のリスト(架空の業務内容)です。それぞれについて、長文の入力・出力を
伴う業務かどうかを判定し、AIモデルの更新によるコスト削減効果が大きいと見込まれる順に並べ替えてください。
以下はAIモデル更新前後で同じ入力に対して得られた出力(架空の契約書レビュー結果2パターン)です。
論点の抽出漏れがないか、表現の正確さに違いがないかを比較し、差分を箇条書きで示してください。
最終的な精度の判断は行わず、比較結果の提示に留めてください。

モデル更新時に決めておく守秘義務の論点

モデルを更新する際、既存の契約がAPI経由の法人向けプランであれば、データ利用ポリシー自体は更新前後で大きく変わらないのが通例ですが、契約形態やプラン名が変わる場合は、データ利用ポリシーの適用条件も併せて確認しておく必要があります。弁護士は弁護士法第23条、税理士は税理士法第38条、公認会計士は公認会計士法第27条で、業務上知り得た秘密を漏らしてはならない旨が定められています(e-Gov法令検索 弁護士法第23条、e-Gov法令検索 税理士法第38条、e-Gov法令検索 公認会計士法第27条)。

事務所規程にモデルの利用範囲を明記している場合、モデル名を規程本体に固定していると、今回のような更新のたびに規程の書き直しが必要になります。規程では、契約しているベンダーの標準モデルを利用するという形で運用の枠組みを定め、具体的なモデル名は別紙の運用マニュアルで管理する運用例が考えられます。これらは規範として断定するものではなく、各事務所の実情に応じて調整する前提のものです。

顧問先への説明では、モデルの更新によって出力の傾向が変わる可能性があること、有資格者による最終確認の工程は更新後も変わらず維持されることの2点を伝えておくと、説明責任を果たしやすくなります。

司法書士・行政書士・社会保険労務士のように、それぞれ司法書士法第24条・行政書士法第12条・社会保険労務士法第21条で業務上知り得た秘密の保持義務が定められている職種についても(e-Gov法令検索 司法書士法第24条、e-Gov法令検索 行政書士法第12条、e-Gov法令検索 社会保険労務士法第21条)、考え方は同様です。モデルが更新されても、顧問先情報の入力範囲や匿名化の運用ルール自体を見直す必要は通常はなく、既存の規程をそのまま適用できるかどうかを確認する作業が中心になります。

モデル更新でよくある失敗例と回避策

一つ目の失敗例は、ベンチマークの数値だけを見て、事務所の実際の業務でも同程度の精度向上があると思い込み、更新後の出力を十分に確認しないまま運用を続けてしまうケースです。回避策は、更新直後の一定期間は旧モデルと新モデルの出力を並行して比較し、有資格者が差分を確認する期間を設けることです。

二つ目の失敗例は、Mythos 5.1のような限定提供のモデルに強い関心を持ち、通常の契約プロセスでは利用できないにもかかわらず問い合わせに時間をかけてしまうケースです。回避策は、まず自事務所が通常契約で利用できる範囲(Fable 5.1)で更新の効果を確認し、限定提供モデルは情報収集にとどめることです。

三つ目の失敗例は、コスト削減率の数値を事務所全体の請求額にそのまま当てはめてしまい、実際の請求額との乖離に後から気づくケースです。回避策は、更新後1〜2か月分の請求額を実際に確認し、業務内容ごとの削減効果を事務所独自に把握し直すことです。

四つ目の失敗例は、性能ベンチマークの向上幅(Terminal-Bench 4.0での42.0%から55.8%への向上等)を根拠に、有資格者による確認工程そのものを簡略化してしまうケースです。ベンチマークの向上は特定の試験条件下での結果であり、事務所固有の業務での正確性を保証するものではないため、確認工程を省略する判断にはつながりません。

導入にかかる費用と体制

Anthropicの発表によれば、Fable 5.1への更新自体に追加の初期費用は生じず、既存の契約の範囲内でモデルが切り替わる、または任意のタイミングで切り替えられる形が想定されています(Introducing Claude Fable 5.1 and Claude Mythos 5.1)。事務所側の負担としては、更新前後の出力比較に充てる担当者の稼働時間が中心になります。運用の主担当は、AI活用を日常的に主導するパートナーかシニアスタッフが持ち、更新後1か月程度は月次より短い頻度で請求額と出力品質を確認する期間を設けると、想定外のコスト増や精度低下に早く気づきやすくなります。

複数のモデルを併用している事務所では、Fable 5.1への更新と並行して、他のベンダーのモデルとの費用比較も定期的に行っておくと、特定のベンダーへの依存によって価格交渉力が弱まることを避けやすくなります。

今後の展望と考察

AIベンダー各社のモデル更新サイクルは今後も続くと見込まれ、事務所が更新のたびに一から判断基準を作り直すのは非効率です。コスト・精度・利用範囲という3つの軸をあらかじめ運用ルールとして固定しておけば、モデル名が変わっても同じ枠組みで判断できる、という点が今後の実務上の論点になります。また、Mythos 5.1のような限定提供モデルの提供範囲が将来的に広がるかどうかも、士業事務所にとっては注視すべき事項です。仮に将来、士業事務所向けの専門プログラムのような形でMythos系モデルへのアクセスが広がった場合には、通常のFable系モデルとは別に、利用範囲や費用体系を改めて確認する必要が出てくると考えられます。

よくある質問

Fable 5からFable 5.1への更新は必須ですか

Anthropicの発表内容からは、更新が義務付けられているとの記載は見当たりません。ただし、旧モデルの提供終了時期が別途案内される可能性があるため、契約しているベンダーやプランの案内を確認しておくことが実務的です。

Mythos 5.1は士業事務所でも申請すれば使えますか

Anthropicの発表では、Mythos 5.1は信頼できるアクセスプログラムに参加する専門家向けに限定されているとされています。一般的な士業事務所の業務範囲では、通常はFable 5.1の利用を前提に検討するのが現実的です。

精度が上がったという発表内容はそのまま信用してよいですか

Anthropicが公表しているのは、Terminal-Bench 4.0などの特定の試験条件下でのベンチマーク結果です。事務所が実際に扱う業務での精度は、実際の出力を比較して確認することが前提になります。

コスト削減率はどの業務にも同じように当てはまりますか

Anthropicの発表では、典型的な業務で約25%、複雑なコーディング作業では最大約45%という異なる削減率が示されています(出典: 前掲Introducing Claude Fable 5.1 and Claude Mythos 5.1)。業務内容によって削減率は異なるため、事務所ごとに実際の請求額で確認することが実務的です。

モデル名を顧問先に説明する必要はありますか

法令上、モデル名の開示が義務付けられているわけではありませんが、AI利用の有無や、有資格者による最終確認の工程を維持していることを説明できる状態にしておくことは、事務所の情報管理体制の説明責任として有効です。

旧モデルのFable 5はいつまで使えますか

Anthropicの発表内容には、Fable 5の提供終了時期についての明記は見当たりません。提供終了の案内は別途行われる可能性があるため、契約しているベンダーやプランの案内を定期的に確認しておくことが実務的な対応になります。

更新後に精度が下がったと感じた場合はどうすればよいですか

まずは具体的にどの業務でどのような差異が出たかを記録し、旧モデルの出力と比較することが実務的な最初の対応です。差異が業務に支障をきたす水準であれば、契約プランの設定によっては旧モデルへの切り戻しが可能かどうかをベンダーに確認する選択肢もあります。

参考文献

事務所のモデル選定の考え方についてはClaude Opus 5とGPT-5.6・Gemini 3.7 士業事務所が選ぶ3つの判断軸、Claude Mythos 5のセキュリティ機能についてはClaude Mythos 5がClaude Securityへ開放 士業事務所の情報漏えい検知5論点も参考にしてください。

※士業のチカラでは、生成AIの導入支援から運用最適化まで、貴事務所の業務に合わせたカスタマイズ提案を行っています。無料相談(30分)も実施中ですので、お気軽にお問い合わせください。
https://shigyonochikara.jp/contact/

本記事の作成体制について

本記事は士業のチカラ編集部が、公表されている一次情報のみを根拠に作成しています。法令の条文はe-Gov法令検索の原文で、行政の見解は各府省庁の公表資料で、それぞれ確認したうえで記載しています。引用元は本文中および参考文献にすべて明示しています。

本記事には特定の資格者による監修は入っていません。個別の事案について法令の当てはめや手続の可否を判断する必要がある場合は、当該分野の有資格者にご相談ください。本記事は一般的な情報提供を目的としたものであり、個別具体的な法律判断・税務判断・労務判断を提供するものではありません。

記載内容に誤りを見つけられた場合は、お問い合わせよりご指摘ください。確認のうえ速やかに訂正し、訂正履歴を記事内に残します。編集方針の詳細は運営者情報をご覧ください。