AIの安全装置を外す商用サービス登場 士業事務所が備える3つの論点

AIの安全装置を外したモデルを提供する商用サービスが登場しました。専門家の賛否とIPAの10大脅威2026で3位初選出という数字をもとに、士業事務所が備える3つの論点を整理します。

AIの安全装置を外す商用サービス登場 士業事務所が備える3つの論点

AIの安全装置を外したモデルを提供する商用サービスが登場しました。

高性能なオープンウェイトのAIモデルから、有害な依頼を断る仕組みを取り除いた版を、ブラウザとAPIから使えるようにする事業者が現れました。TechCrunchが2026年9月3日に報じたもので、これまで技術者コミュニティの中で行われてきた手法が、そのまま商用サービスの形になった点が新しいところです。安全装置を外したAIが誰でも触れる場所に置かれると、攻撃側の道具も守る側の道具も同時に増えます。士業事務所にとっては、自分たちが使うツールの話というより、事務所を狙う攻撃の前提が変わる話です。この記事は公開資料と報道をもとに、士業のチカラ編集部が事実関係を整理したものです。

サーバールームに並ぶ通信機器のラック

何が起きたのか

商用サービスとして立ち上がったのは、モデルの「拒否する性質」を取り除いたバージョンを、事業者側でホスティングして提供する仕組みです。前掲のTechCrunchによれば、対象にはZ.aiが公開したばかりのGLM-5.3が含まれ、利用者はウェブブラウザからの問い合わせでもAPI経由でも呼び出せます。運営会社は昨年末に立ち上がり、2026年3月に法人化されたばかりで、外部からの資金調達はまだ受けていないと同記事は伝えています。

この「アブリテレーション」と呼ばれる手法自体は新しいものではありません。オープンウェイトのモデルから拒否の挙動を取り除く試みは以前から行われており、Hugging Faceには同種の改変済みモデルが多数置かれています。今回の変化は技術ではなく流通のほうにあります。自分でモデルをダウンロードし、動かすためのGPUを確保するという手間が消えて、アカウントを作れば使える状態になったということです。

実際にTechCrunchは無料アカウントを作成して改変版のGLM-5.3を試し、ブラウザのパスワードを盗み出すプログラムや、危険な病原体の取り扱いに関する手順の生成に応じたと報じています。運営側は利用者が自分でガードレールを追加できる仕組みを用意しており、自殺に関する指示は出なかったともされていますが、本人確認については決済に使うクレジットカードの記録以外はまだ設けていない段階だと同記事は伝えています。

賛否がはっきり割れている

この件が注目されているのは、セキュリティの専門家の間でも評価が分かれているためです。

運営側の主張は、攻撃者はすでに同じことを自前でやっているのだから、防御側が同等の道具を持てなければ検証が成り立たない、というものです。銀行や航空会社のシステムを対象に攻撃側の視点で検証を行う事業者が顧客に含まれており、市販の状態のモデルでは拒否されて検証にならない場面がある、と創業者は説明しています。

反対側の指摘も具体的です。AI安全性に取り組む非営利団体CivAIの研究責任者は、TechCrunchに対して、この改変は「モデルを反社会的な人格に作り変えるようなものだ」と述べています。同氏はウォール・ストリート・ジャーナルへの寄稿で、有害な用途を検知して遮断する仕組みを提供側に求めることや、高性能GPUを貸し出す事業者に利用者の本人確認を求めることを提案しています。

一方で、実務側からは効果を割り引いて見る声も出ています。攻撃側視点の検証を手がけるFabraixの最高経営責任者は、自社では改変版よりも追加学習による調整を使っており、拒否を取り除く処理はモデルの知識や能力そのものを削る面があるため、本当に有害な用途に使おうとしても期待どおりには働かないと述べています。Armadinの創業者も、直近の世代までは改変を経なくても意図した挙動を引き出せていたと語っており、Safe Intelligenceの技術責任者は能力低下を認めつつも検証用途には意味があるという立場です。

ネットワークの接続を示すデータのイメージ

士業事務所から見た3つの論点

この報道から士業事務所が持ち帰れる論点は、3つに整理できます。

1つ目は、攻撃の前提が変わることです。情報処理推進機構(IPA)が公表した情報セキュリティ10大脅威 2026では、組織向けの脅威として「AIの利用をめぐるサイバーリスク」が3位に初選出されました。この順位は、2025年に起きた事故や攻撃の状況からIPAが候補を選び、研究者や企業の実務担当者ら約250名の選考会が投票して決めたものです。1位は11年連続でランサム攻撃、2位は8年連続でサプライチェーンや委託先を狙った攻撃であり、AI関連が初回からその次に置かれた形になります。改変済みモデルが安価に流通すれば、フィッシングメールの日本語の自然さや、標的を調べる速度は上がっていきます。

2つ目は、事務所側で見る指標が「疑わしい日本語」から別のものへ移りつつあることです。文面の不自然さで見分ける運用は、生成の質が上がるほど当てにしにくくなります。送金や口座変更の依頼を別の連絡手段で裏取りする手順、振込権限の分離、添付ファイルの扱いといった、文面に依存しない部分の確認が実務の中心になります。ビジネスメール詐欺はIPAの同じ一覧で10位に入り、9年連続の選出となっています。

3つ目は、事務所が導入するAIツールの選び方です。今回の件は事務所が使う側の話ではありませんが、「そのモデルがどこで動き、誰がどんな条件で改変できるのか」を確認する動機にはなります。オープンウェイトのモデルを自社で動かす構成は守秘義務の観点で選ばれることがある一方、改変が容易であるという性質も同時に持ちます。ベンダーへの確認事項はAIツールのベンダーに聞く確認質問リストで整理しています。AIの悪用によるサイバー攻撃の増加についてはAIツールでサイバー攻撃が倍増したという警告、モデル側の能力評価についてはAstraのサイバー分野の評価も合わせて読める内容です。

今後の動き

焦点は、規制をどこに置くかに移りそうです。重みが公開されたモデルについて改変そのものを止めることは難しいという見方が、TechCrunchが取材した専門家の間では多数派でした。そうなると、提供事業者に検知の仕組みを求める、計算資源の貸し手に本人確認を求める、といった周辺での介入が議論の対象になります。日本でもIPAがAI利用者向けのセキュリティ情報を公開しており、こうした一次情報が更新されるタイミングは追いかけておく価値があります。

事務所の実務としては、いま何かを入れ替えるという話ではありません。バックアップの取り方、権限の分け方、社外からの依頼を裏取りする手順といった、以前から言われてきた部分が、攻撃側の道具が安くなるぶんだけ効いてくるという整理になります。

まとめ

AIの安全装置を外したモデルを商用で提供するサービスが登場し、改変済みモデルの入手障壁が下がりました。専門家の評価は「防御側にも同じ道具が必要」と「実害を招く」で割れています。IPAの10大脅威2026では「AIの利用をめぐるサイバーリスク」が3位に初選出されており、士業事務所にとっては攻撃の前提が変わるという読み方が実務に近いところです。

参考文献

※士業のチカラでは、生成AIの導入支援から運用最適化まで、貴事務所の業務に合わせたカスタマイズ提案を行っています。無料相談(30分)も実施中ですので、お気軽にお問い合わせください。
https://shigyonochikara.jp/contact/

引用元: TechCrunch

本記事の作成体制について

本記事は士業のチカラ編集部が、公表されている一次情報のみを根拠に作成しています。法令の条文はe-Gov法令検索の原文で、行政の見解は各府省庁の公表資料で、それぞれ確認したうえで記載しています。引用元は本文中および参考文献にすべて明示しています。

本記事には特定の資格者による監修は入っていません。個別の事案について法令の当てはめや手続の可否を判断する必要がある場合は、当該分野の有資格者にご相談ください。本記事は一般的な情報提供を目的としたものであり、個別具体的な法律判断・税務判断・労務判断を提供するものではありません。

記載内容に誤りを見つけられた場合は、お問い合わせよりご指摘ください。確認のうえ速やかに訂正し、訂正履歴を記事内に残します。編集方針の詳細は運営者情報をご覧ください。