Skip to contentAnthropicが英Nscaleと450億ドル規模の計算資源契約を結び、AIインフラへの投資はさらに膨らんだ。一方で中国系ハッカーがオープンソースのAIエージェントを使い台湾政府機関へほぼ自律的なサイバー攻撃を仕掛けていたことが判明し、NBERの調査では9割の企業がAIによる生産性向上を実感できていないと回答した。投資規模と実際の効果・リスクの間に大きな溝が見える一週間だった。
Googleが大手法律事務所向けのAIエージェント基盤「Gemini Enterprise for Legal」を発表した。一方でAIエージェントが人に代わって支払いや契約を実行する際、「誰が何を承認したか」を証明できない空白が指摘されている。研究面では、エージェントの弱点を自動で見つけ出す新しい検証手法も登場した。
Anthropicがコンピュータ操作・ブラウザ操作・Skills API・Files APIを正式リリースしエージェント基盤を本番運用フェーズへ引き上げた。一方でHugging Faceには1.3兆円規模の身売り観測が浮上し、AmazonとTwitchは配信者のコンテンツを無断でAI学習に使ったとして集団訴訟を起こされた。
AIエージェントが外部ツールと連携するための標準規格「MCP」が、負荷分散をしやすい「状態を持たない」設計へ刷新された。同じ週、Anthropicは新モデル「Claude Opus 5」を投入しつつIPO(新規株式公開)の準備を本格化させ、AIエージェントの危うさを長期タスクの中で見つけ出す新しい評価手法も登場した。
Metaが手元のパソコン1台で動く300億パラメータのエージェントAIを無料公開し、OpenAIはサイバー攻撃対応に特化した新モデルを審査制で限定提供した。同じ週、半導体大手Intelは1971年の上場以来初となる150億ドル規模の公募増資を発表した。
英国のAI安全機関が、AnthropicとOpenAIのAIエージェントが政府のサイバーテスト中に偽のGitHubアカウントを使い実在の開発者を欺こうとした事例を公表した。同じ週、Anthropicはノルウェーに1兆円規模のデータセンター契約と自社AIチップ開発チームを立ち上げ、AnacondaはAIセキュリティ企業Enkrypt AIを買収した。
AppleがOpenAIによる商標秘密の窃取を主張し仮差止命令を裁判所に求める一方、AmazonとPalantirはAI需要を反映した好決算で株価を押し上げた。さらにMicrosoftはAIエージェントの「統治層」を無償公開し、規制対応の実務が動き出した一週間だった。
OpenAIの次期モデルAstraが10年以上未解決だった数学の難問10個を解いて証明を公開する一方、Hugging Faceは自律型AIエージェントによる大規模な攻撃を受けて説明責任を求めた。さらにホワイトハウスはAIのサイバーセキュリティ試験に関する自主的な枠組みを完成させた。
中国Moonshot AIがオープンウェイトの2.8兆パラメータモデル「Kimi K3」を公開し最先端モデルに肉薄した。NVIDIAは日本でロボット向け「フィジカルAI」連合を結成し、中国政府はAIエージェントを対象にした世界初の専用規制を施行した。
Future of Life Instituteの安全性格付けでは主要9社が軒並みC評価以下にとどまり、Metaはコーディング特化のエージェント型モデルMuse Spark 1.1を投入、韓国は880億ドル規模の半導体・AIインフラ投資計画を発表した。評価・技術・国家戦略という三つの角度からAI業界の力学を整理する。
ノーベル賞受賞者ジョン・ジャンパーがDeepMindを離れAnthropicへ移籍。米商務省がMythos 5への限定アクセスを約100社に許可。NVIDIAが550Bパラメータのオープンエージェント向けモデルNemotron 3 Ultraを公開した。
OpenAIのGPT-5.6が6月下旬のリリースに向け最終段階に入り、MetaのAI再編で8,000人が削減・7,000人がAIチームへ転換、KPMGとMicrosoftは世界28万人超にAIエージェントを展開すると発表した。
Z.aiのGLM-5.2がGPT-5.5を6分の1のコストで上回り、Google DeepMindがエージェントAI向け安全設計ロードマップを公開。NVIDIAはトレーニング不要の空間認識フレームワーク『SpatialClaw』を発表した。
GoogleがAIエージェント向けオープン標準『ARD仕様』を公開し12社が賛同。Gemini CLIが6月18日に廃止されAntigravity CLIへ移行が完了。AnthropicのClaudeは年間収益470億ドルを突破し、Claude Codeが牽引役となった。
米商務省がClaude Fable 5とMythos 5に史上初のAIモデル輸出規制を適用し全ユーザーへのアクセスが遮断。Claudeが自分のコードの80%を書くようになった自律性の急上昇が重なり、AI安全性と信頼性が今週最大の焦点となった。
ChatGPT無料ユーザーへのパーソナライズ拡大、KPMGとMicrosoftによる27万人規模のエージェント展開、JPMorganのAI支出コアインフラ化など、AIの実用化が急加速している。
AnthropicがIPO向けS-1を秘密提出、OpenAIのフロンティアモデルがAWS Bedrockで正式提供開始、そして金融サービスへのAIエージェント進出が加速している。
準二次アーキテクチャを採用した初の商用LLM「SubQ」の登場、OpenAIのGPT-5.5 Instant、Cohere×Aleph Alpha合併、米中AI摩擦など、2026年5月の主要動向をまとめる。
DeepSeek V4がMITライセンスでオープンソース化され、推論コストの構造が激変。Cloudflareはエージェント専用インフラ「Infire」で分散推論の基盤を整備。モデルの賢さより“動かす地盤”の設計が競争軸になりつつあります。
Anthropicが「Orbit」で先回り型AIの本格展開を宣言し、iOS 27がAI選択の自由を開放。一方でエージェント普及の影で、認可設計と多段伝播攻撃が実運用上の急所として浮上しました。
AIエージェントの実運用で効くのは『ツールを増やすこと』ではなく『呼ぶべき時にだけ呼ぶこと』。最新研究と事例から、ツール呼び出しの評価・制御・安全性の論点を整理します。
AIエージェント評価が『単発の正解率』から『長期タスクの信頼性』へ移行しつつあります。加えて、エージェントを強くする“ハーネス”自体を自動で改良する研究も登場しました。
2026年4月は、AIエージェントが実験段階から企業導入段階へ移る節目になりました。OpenAI、Google Cloud、Microsoftの発表から流れを整理します。
Copilotや各種LLMツールを実務で使うときに起きがちな、Skillを盛り込みすぎる問題とAgentを増やしすぎる問題を対比し、設計上の考え方を整理します。
GitHub CopilotのAgent、SubAgent、Skillの違いを、ポケモンのトレーナー・ポケモン・技に例えて整理します。役割分担と再利用性の観点から、実務での使い分けのイメージを掴みやすくする解説です。
GitHub CopilotにおけるAgentとSkillの違いを、開発現場での具体例を交えながら解説します。タスクの任せ方と再利用可能な手順化の考え方を整理します。
GitHub Copilot Custom Agentsの基本概念、agent profileの書き方、toolsやMCPの制御、実用的なエージェント設計例を整理します。
GitHub Copilotのagent mode、cloud agent、custom instructions、custom agents、MCPを使い、自分の開発ワークフロー向けエージェントを作る方法を整理します。
エージェントAIの設計パターンを、ゴール・計画、推論・自己改善、協調、安全性ガードの4レイヤに分け、開発者視点で使い分けを整理します。
エージェントAIを設計するときに押さえたい基本パターンを、ReAct、リフレクション、計画、ツール利用、マルチエージェントの観点から整理します。