Skip to content

【AIニュース】OpenAIの「常時稼働エージェント」Dots、ホワイトハウスの自主規制協定、そして「計画どおりに動かない」AIエージェント

OpenAIがDevDayで発表した常時稼働エージェント「Dots」、米ホワイトハウスで結ばれたAI企業の自主規制協定、エージェントが宣言した計画を実行できているかを調べた論文を紹介する。

AIは「質問に答える道具」から「仕事を任せる相手」へ変わりつつある。今週は、その流れを象徴する製品発表と、任せる側のルール作り、そして任せて本当に大丈夫なのかを問う研究がそろった。

OpenAIが「Dots」を発表——自分のパソコンを持つ常時稼働エージェント

OpenAIは開発者会議DevDay 2026で、新しいエージェント「Dots」を発表した。エージェントとは、指示を待つだけでなく、自分で手順を考えて作業を進めるAIのことだ。

報道によると、Dotsはそれぞれが専用のクラウド上のパソコンとブラウザを持つ。ChatGPT、SMS、メール、Slackから呼び出せる。4,000種類ほどのアプリ連携(プラグイン)を使い、定期的な作業や、やり残しのフォローも続ける。一部の作業は「サブエージェント」と呼ばれる手下のAIに任せることもできる。

まずはChatGPT Pro、Business Premium、Enterpriseの利用者向けだ。ユーザーが権限やルールを決められ、特定の操作の前に確認を求める設定もある。詳しくはBetaNewsや9to5Googleの報道が分かりやすい。

実務上の示唆

  • 「AIに聞く」から「AIに任せる」へ、業務の設計を見直す時期に入った
  • 最初は確認を必須にして、小さな定型業務から任せるのが安全だ
  • 権限の範囲(どのアプリに触れてよいか)を先に決めておく
  • 他社の同種製品との比較も、早めに始めておくとよい

ホワイトハウスで「AI企業の自主規制協定」に署名

米国では、トランプ大統領がAI企業のトップをホワイトハウスに集めた。ジョンソン下院議長とともに、自主的な協定「White House Accord on Superintelligence」を発表した。超知能(人間を大きく超えるAI)の開発に関する、企業側の約束をまとめたものだ。

CNNやNPRによると、NvidiaのJensen Huang氏、AnthropicのDario Amodei氏、GoogleのSundar Pichai氏、MetaのMark Zuckerberg氏、xAIのElon Musk氏らが出席した。OpenAIからは社長のGreg Brockman氏が参加した。

内容は、社内の管理体制、監視、外部による評価、取締役会による監督の4本柱だ。「何層もの監査」を行う約束も含まれる。トランプ氏は「憲法のようなもの」と呼び、全体を見守る委員会の設置も検討していると述べた。

ただし、これは法律ではなく自主的な約束だ。違反した場合の罰則は示されていない。背景には、AIエージェントが暴走する事例が続いたことへの懸念がある。

実務上の示唆

  • 法規制ではなく「業界の約束」が先に動く局面だ。今後の取引先の選定基準に影響しうる
  • 外部評価や監査の情報開示が増えれば、ベンダー選びの材料になる
  • 自社でも、AI利用の責任者と記録の残し方を決めておきたい

研究:AIエージェントは「宣言した計画」を守れているか

エージェントは最初に「こう進める」という計画を立てる。では、実際にその計画どおりに動いているのか。arXivに公開された論文「Do LLM Agents Execute the Plans They Declare?」が、この点を調べた。

結果は意外だった。一般的な「計画してから実行する」方式(Plan+ReAct)では、3つのベンチマーク(性能測定用の課題集)のうち、宣言した計画の構造が最後まで保たれた割合は22〜45%にとどまった。特に計画が長いほど崩れやすい。

研究チームは「Planning-as-Routing」という方法を提案した。AIが計画の型を4つから選ぶ。その型は「決まった手順」「順番に進める」「階層に分ける」「探索する」の4つだ。選ばれた型ごとに、専用のプログラムが実行を管理する。

すると、家庭内作業を模した課題ALFWorldの成功率は0.48から0.92に上がった。ソフトウェア修正の課題SWE-bench Verifiedでも0.36から0.44に改善した。ただし、AI自身が最適な型を選ぶ力はまだ不安定で、例を見せると改善する場合もあった。

実務上の示唆

  • 「計画を立てた」という報告と「実際にやった」ことは別だと考える
  • 長い作業は、途中経過の確認ポイントを人間が挟むと安全だ
  • 自由に動かすより、手順を決めた実行の枠組みで包む方が安定しやすい
  • 上のDotsのような常時稼働型ほど、実行ログの確認が大切になる

まとめ

今週のニュースは、一本の線でつながっている。OpenAIのDotsは、AIに仕事を任せる流れを一段進めた。ホワイトハウスの協定は、その力が大きくなる中で、企業の自主ルールを急いで整えようとする動きだ。

そして研究は、AIが「やると言ったことを本当にやるのか」という基本の問いに、まだ課題が残ると示した。任せる範囲を広げるほど、確認と記録の仕組みが重要になる。便利さと安全性を同時に考える姿勢が、これからの実務では欠かせない。