8月14日に何が変わるのか

Anthropicが8月7日に発表しました。8月14日から、Claude Code の権限モードの初期値が変わります。これまでは「AIが実行しようとする操作を、人が毎回ひとつずつ承認する」のが既定でした。8月14日以降はPro・Max・Teamのプランを対象に順次、auto mode(自動モード)が既定になります。

誤解しやすいので先に線を引いておきます。既定が変わるだけで、これまでの「毎回人が承認する手動モード」は残ります。設定でいつでも戻せます。つまり「勝手に自動化される、逃げ道がない」という話ではありません。変わるのは、何もしなければどちらで動くか、という初期値です。

ククルデザインはお客様のWeb制作やAI・DX導入の伴走にClaude Codeを実務の主軸として使っています。承認ゲートの初期値が変わることは、私たちにとっては提供条件そのものの変更です。だから「へえ」で済ませず、自社の運用をどう合わせるかを決めました。その判断も含めて書きます。

「危険なコマンドが素通りする」ではない

ネット上には「auto mode=危険コマンドも自動で通る」という要約が出回っています。これは正確ではありません。実際の仕組みはこうです。

auto mode では、AIが実行しようとする一つひとつのシェルコマンドや操作を、別の分類器(classifier)が審査します。安全と判定した操作だけが自動で進み、消してしまうと戻せない操作・破壊的な操作・作業範囲の外に出る操作は、そこで止まって人に承認を求めます。承認の主体が「人の逐次確認」から「AIの分類器+要所だけ人」へ移る、という変更です。全部を人が見るのをやめて、止めるべき所だけを機械が拾って人に回す。そういう設計です。

AIエージェントの作業を一本の道として描き、道の途中にあるゲートで、消すと戻せない操作や破壊的な操作だけを人の手が止め、安全な操作はそのまま通り抜ける様子を示した概念図。文字や数字は入れない

Anthropicが示したテスト結果が、この設計の狙いを裏づけています。危険なコマンドを、分類器は約89%検出しました。一方、人が手動で承認する方式での検出は約14%にとどまります。しかも人の検出率は、セッションが長くなるほど下がり、5%前後まで落ちました。承認画面を何十回も見続ければ、人は流し読みになる。分類器は疲れないので検出率が一定に保たれる。「人が全部見るほうが安全」という直感が、数字では裏返っています。

ただし、分類器を過信はできない

数字が良くても、Anthropic自身が留保をつけています。分類器はリスクをゼロにはできない。本番環境への変更は、これまで通り人のレビューを推奨する。ここははっきり書かれています。

もう一つ、見落とせない穴があります。第三者が仕込んだ悪意あるパッケージ経由での情報持ち出しは、分類器でも検出しきれないという指摘が残っています。個々のコマンドは安全に見えても、外部から入り込んだコードが裏で通信していれば、一つずつの審査では拾いにくい。だから「auto modeにしたから安心」ではなく、「どこまでを機械に任せ、どこは人が握るか」を自分で決める必要があります。

費用の面は素直に良い変更です。分類器が使う追加のトークンは、Anthropicが自社で吸収し、利用者には課金しません。安全側の処理を増やしても請求は増えない。ここは正直に評価できます。

ククルデザインの線引き

私たちは全社で一律に決めるのをやめ、セッションの中身で分けることにしました。判断は単純です。お客様のデータや本番環境に触れるセッションは、手動モードに戻す。自分専用の実験環境や、壊れても作り直せる下書きレベルの作業は、auto modeのまま任せる。

作業セッションを左右に並べた対比図。左は顧客データや本番環境を扱うセッションで、人が鍵をかけて手動で見張っている。右は自分専用の実験環境で、AIに任せて自動で進んでいる、という運用の使い分けを表す。文字や数字は入れない

理由は責任の所在です。分類器の検出率が人より高いとしても、お客様の顧客名簿や公開中のサイトに対して「機械が安全と判定したので通しました」と説明する場面を、私たちは作りたくない。止める判断を人が握っておく。効率が数%落ちても、その数%は保険料だと考えています。逆に、自分の手元で試すだけの作業まで毎回承認していたら、auto modeの利点を捨てることになる。だから境界は「壊れたときに誰が困るか」で引きました。

8月14日までに確認しておくこと

開発者がノートパソコンの設定画面で、自動モードと手動モードを切り替えるトグルスイッチに手を伸ばしている様子を、落ち着いた雰囲気で描いたイラスト。文字や数字は入れない

難しい設定変更は要りません。やることは三つです。

  • いま使っているClaude Codeのプランが、8月14日以降にauto mode既定へ切り替わる対象か(Pro・Max・Team)を確認する
  • お客様のデータや本番環境に触れるプロジェクトでは、権限モードを手動に戻す設定を入れておく
  • チームで使っているなら、「どのセッションは自動で、どれは手動か」の線引きを一度言葉にして共有する

初期値が変わる日を、自分の運用を見直すきっかけにする。それだけで、便利さと安全のどちらかを丸ごと諦めずに済みます。

迷ったら、機械に任せる範囲から決める

今回の変更の本質は「AIが賢くなったから承認を省く」ではありません。「人が全部確認する方式には、疲れて見落とすという弱点がある」という現実に、初期値を合わせにきた変更です。数字はその弱点を突いています。

とはいえ、任せる範囲を決めるのは使う側の仕事です。ククルデザインはAI・DX導入の伴走で、こうした「どこまでAIに任せ、どこは人が握るか」の線引きを、お客様の業務に合わせて一緒に設計しています。自社の業務にAIを組み込みたい、けれど任せ方の判断で迷っている、という方はククルデザインまでご相談ください。