AI大手5社の内部統制が最高C+ 士業事務所のAIガバナンス3論点

Guidelightが2026年8月にAI大手5社の内部統制を評価し最高C+。AnthropicからMetaまでの結果と、士業事務所のAIガバナンスで見直したい3論点を整理します。

AI大手5社の内部統制が最高C+ 士業事務所のAIガバナンス3論点

AI大手5社の内部統制は最高でC+だとGuidelightが公表しました。

非営利団体のGuidelightが2026年8月、AIを開発する大手5社が自社内部で使うAIシステムをどこまで管理できているかを評価し、最も高い評価でもC+にとどまったと公表しました。The Decoderが2026年8月19日に伝えています。AIを提供する側の内部統制がまだ発展途上にあるという材料は、AIを業務に取り込む士業事務所にとって、ベンダー選定とAIガバナンスを考えるうえでの判断材料になります。本記事は公表された事実の整理を目的としており、個別事案の法的評価は行いません。

Guidelightが公表したAI大手5社の内部統制評価

Guidelightは、AI開発企業が自社内部で稼働させるAIシステムに対して基本的な管理策をどこまで適用しているかを評価し、5社のいずれも十分には適用できていないという結果を示しました。対象はAnthropic、OpenAI、Google、xAI、Metaの5社で、評価はシステムカードや安全性レポート、ブログ記事といった公開情報のみを材料としています。非公開の社内資料には踏み込んでいないため、実際の運用状況とは差がありうる点は読み手側で割り引く必要があります。

評価軸は6つの基本的な実務で、社内AIの活動ログを残すこと、リスクの高い操作を審査の仕組みを通すこと、緊急停止にあたるサーキットブレーキング、意図から外れたモデルを封じ込める計画などが含まれます。結果はAnthropicとOpenAIがC+で最上位、Googleがロードマップを伴うD+、xAIがD−、MetaがFという並びでした。Googleについては詳細なロードマップが公開されている点が評価に反映されています。

全体の傾向として、5社は不審な挙動を検知する部分では相対的に良い評価を得た一方、予防と封じ込めの部分で評価が低くなりました。Guidelightは、OpenAIで安全性部門を率いていたPage HedleyとSteven Adlerが設立した独立系の非営利団体だと説明されています。評価の詳細はGuidelightの公表資料にまとめられていますが、原典の全文については本記事執筆時点で内容を直接確認できていないため、詳細の数値は要確認としておきます。

なぜこの評価が士業のAIガバナンスに関係するのか

この評価が士業事務所にとって意味を持つのは、AIガバナンスが「自事務所の中だけで完結しない」構造になっているからです。事務所が生成AIに入力した情報は、ベンダー側のインフラで処理され、ベンダー側のログ管理・アクセス制御・停止手順の上に乗ります。つまり、事務所の情報管理体制の実効性は、選んだベンダーの内部統制の水準にも左右されます。今回の評価は、その外側の層がまだ発展途上であることを、公開情報ベースで可視化したものと読めます。

もっとも、今回評価されているのは各社が社内で使う内部AIシステムの管理策であって、企業向けに提供されている商用サービスの契約条件やデータ保持の設計そのものではありません。事務所として確認する対象は、あくまで自事務所が結んでいる契約の種別と、そこで約束されているデータの取り扱いです。入力データが学習に使われるのか、ログがどれだけの期間保持されるのか、どのプランとどのモデルにその条件が適用されるのかは、ベンダーの公式ポリシーで個別に確認する領域になります。この点はOpenAIのゼロデータ保持と士業の守秘義務でも整理しています。

日本国内では、総務省と経済産業省がAI事業者ガイドライン(第1.1版)を2025年3月28日に公表しており、開発者・提供者・利用者それぞれの立場での基本的な考え方が示されています。より新しい版が出ている可能性については要確認ですが、公表状況はJapan AISIのお知らせからたどれます。事務所は利用者の立場にあたり、提供者側の取り組みを前提として自らの運用を組み立てる関係にあります。

今後の動きと、士業事務所が見ておきたい観点

Guidelightの評価は初回であり、今後も継続的に更新されていくかどうかが最初の注目点になります。単発の格付けであれば一時点のスナップショットにとどまりますが、定期評価として続けば、ベンダーの改善速度を時系列で比較する材料になります。Googleのようにロードマップを公開する動きが他社にも広がるかどうかも、あわせて見ておきたいところです。

事務所側の観点としては、3つに整理できます。第一に、AIベンダーの選定において、価格と精度だけでなく、安全性や統制に関する公開情報の厚みを比較材料に加えるという見方です。第二に、事務所内部でのログと権限の設計です。ベンダー側の統制に依存しきらず、誰がどのAIに何を入力したかを事務所側でも追える状態にしておくという考え方で、これはAIエージェントの権限設定の議論とも重なります。第三に、想定外の挙動が起きたときにAI利用を止める手順を、あらかじめ言語化しておくという整理です。今回の評価で各社の弱点とされた「予防と封じ込め」は、規模は違えど事務所側にも同じ構図で当てはまる論点です。

こうした対応をすでに進めている事務所もあれば、まずは利用実態の棚卸しから始める段階の事務所もあります。いずれにしても、外部ベンダーの統制水準が可視化され始めたこと自体が、事務所のAIガバナンスを設計するうえでの新しい材料になりました。

まとめ

Guidelightは2026年8月、AI大手5社の内部AIシステムに対する管理策を公開情報から評価し、AnthropicとOpenAIのC+が最高で、GoogleはD+、xAIはD−、MetaはFという結果を示しました。検知は比較的できている一方、予防と封じ込めが弱いという傾向です。士業事務所にとっては、ベンダー選定の比較軸、事務所内のログと権限設計、停止手順の言語化という3点を見直す材料になります。

参考文献

※士業のチカラでは、生成AIの導入支援から運用最適化まで、貴事務所の業務に合わせたカスタマイズ提案を行っています。無料相談(30分)も実施中ですので、お気軽にお問い合わせください。
https://shigyonochikara.jp/contact/

引用元: The Decoder

本記事の作成体制について

本記事は士業のチカラ編集部が、公表されている一次情報のみを根拠に作成しています。法令の条文はe-Gov法令検索の原文で、行政の見解は各府省庁の公表資料で、それぞれ確認したうえで記載しています。引用元は本文中および参考文献にすべて明示しています。

本記事には特定の資格者による監修は入っていません。個別の事案について法令の当てはめや手続の可否を判断する必要がある場合は、当該分野の有資格者にご相談ください。本記事は一般的な情報提供を目的としたものであり、個別具体的な法律判断・税務判断・労務判断を提供するものではありません。

記載内容に誤りを見つけられた場合は、お問い合わせよりご指摘ください。確認のうえ速やかに訂正し、訂正履歴を記事内に残します。編集方針の詳細は運営者情報をご覧ください。