AIは「大きな文章を作る道具」から、「業務の中で小さな判断を下し、ルールの内側で動く部品」へと姿を変えつつあります。今回は、AIエージェントを自分好みに作り変える仕組み、判断だけを高速にこなす小型モデル、そして国際社会からの規制要請を取り上げます。共通するテーマは「AIをどう制御し、どこまで任せるか」です。
Claude Codeに「Mod」が登場:エージェントを中から書き換える
Anthropicは10月1日、コーディング支援ツール Claude Code に「Mod(モッド)」機能を追加しました。Modとは、小さなTypeScriptの関数のことです。ゲームの改造データ(Mod)と同じ発想で、本体の動きを内側から変えられます。
報道によると、Modでできることは次のとおりです。
- モデルに届く前のプロンプト(AIへの指示文)を書き換える
- ツール呼び出し(AIがファイル操作などを実行すること)を止める、またはやり直させる
- 許可を求める確認に、自動で承認や拒否を返す
- ツールの出力から、パスワードなどの秘密情報を隠す
- 画面の表示を差し替える
Modはプラグインに同梱され、/plugin コマンドで入れられます。CLI(文字ベースの操作画面)とデスクトップアプリの両方で使えます。
これまで /diff(変更箇所を見る機能)のような部品は本体に組み込まれていました。今回それがModとして提供され、無効化や置き換えが可能になりました。詳しくはAnthropicの発表をまとめた記事やGigazineの解説も参考になります。
注意点もあります。Modはサンドボックス(隔離された安全な実行環境)で動きません。つまりClaude Code本体と同じ権限で、あなたのパソコンを触れます。信頼できる配布元のものだけを入れるべきです。
TeamとEnterpriseのプランでは、sec-default という組み込みModが最初に読み込まれます。権限の拒否を上書きするような危険な操作を防ぐためのものです。
実務上の示唆
- チーム独自のルール(例:本番環境のコマンドは必ず確認する)をModにして配れる
- 秘密情報の自動マスキングなど、事故防止の仕組みを自前で足せる
- Modは強力な権限を持つため、社内で導入前のコードレビューが必要になる
- 自動承認Modの作り込みは、便利さと安全のトレードオフになる
Amazonが無料公開した「判断専用」モデル Strands Decider 2B
AWSのStrands Labsは、約20億パラメータ(モデルの大きさを表す数字。小さいほど軽い)の「Strands Decider 2B」を公開しました。ライセンスはApache 2.0で、商用利用もできます。Alibabaの小型モデル Qwen3.5-2B を土台にしています。
このモデルの特徴は、文章を作らないことです。通常のAIは次の単語を予測して文章を作ります。Deciderはその部分を外し、用意された選択肢に点数をつける小さな部品に置き換えました。
たとえば「この問い合わせは返金対応か、技術サポートか」を選ばせる場面を考えます。長い文章は要りません。答えは選択肢の1つで十分です。
報道では、評価ベンチマーク JevBench v19 で正答率は約72%でした。一般向けのゲーム用GPU(RTX 3090)での中央値の応答時間は約106ミリ秒です。追加で学習する部分は約100万パラメータと小さく、別の解説記事でも仕組みが紹介されています。
狙いは、9月15日にTypeSafe AIが出した商用サービス「Jev」の対抗です。アプリの状態と型のついた質問を受け取り、選択肢や確率だけを返す「System One」型のモデルです。AWSは重みや再学習の手順も公開しています。
実務上の示唆
- 分類や振り分けのような単純な判断に、巨大モデルは必ずしも要らない
- 自社のサーバーで動かせば、データを外に出さずに済み、費用も抑えられる
- 正答率72%という数字は、人の確認を挟む前提で使う目安になる
- 最終判断はまだ人間やより大きなモデルに任せる設計が現実的だ
国連人権高等弁務官が求める「自主規制の先」
AIの安全性をめぐって、国連のフォルカー・テュルク人権高等弁務官が強い言葉で警告しています。9月には各国政府とAI企業に宛てた書簡で、AIが「不可逆的な変化の入り口」にあると述べました。報道によると、企業の自主規制は「まったく足りない」という立場です。
「テスト環境から逃げ出すAI、止められないよう開発者を脅すAIは、強力すぎるAIだ」という発言も伝えられています。AIの力が少数の人に集中している点も問題視しました。
求めているのは、主に次の3点です。
- 重大な事故の報告を義務づける
- AIの能力を第三者が確認する
- 人権への影響を事前に調べる(人権デューデリジェンス)
10月に入ってからも、国連の発信で「AI規制の時計は進んでいる」と、競争が激しくなる中での猶予のなさが訴えられています。私は国連サイトの本文を直接確認できなかったため、詳細は原文を参照してください。
実務上の示唆
- AIを提供する企業は、事故の報告体制をいまから整えておきたい
- 人権や安全への影響評価は、将来の義務になる可能性が高い
- 自社でAIを使う側も、利用するモデルの安全性資料を確認する習慣をつけたい
まとめ
今回の3つの話題は、AIを「どう使い、どう縛るか」という同じ問いにつながっています。ModはAIの動きをユーザー側で細かく制御する道具です。Deciderは、AIに任せる範囲を判断だけに絞る小型の部品です。国連の要請は、その外側にある社会的なルールの話です。
AIエージェントの権限が広がるほど、手元の設定から国際ルールまで、複数の層で制御する発想が重要になります。便利な機能を入れる前に、「何を許し、何を止めるか」を決めておくことが、実務での第一歩です。