AIエージェントが複数のWebサイトにまたがる作業を担うようになるにつれ、Google Chromeの役割は、人にページを表示することから、人とソフトウェアの間で作業を調整することへと移っていく可能性があります。Chromeのエンジニアリングとプロダクトの責任者は、バックグラウンドの自動化を支えつつ、ユーザーが読み、判断し、介入し、承認する場を残すブラウザーの姿を描いています。
2026年6月には、自動化されたソフトウェアによるトラフィックが、人が生み出すWebトラフィックを初めて上回りました。世界の企業によるAIエージェントの導入は、年8,000%のペースで伸びていると推定されています。Chromeにとっての現実的な問いは、ソフトウェアが人に代わってWebを使えるようになったとき、人がブラウザーに何を求めるかです。
任せることはブラウザーを離れることではない
Chromeのプロダクト担当バイスプレジデントは、Web上の作業をひとつのスペクトラムとして捉えています。一方の端では、エージェントがカレンダーを確認して朝のブリーフィングを用意し、人が開かれるページを一つひとつ追う必要はありません。中間では、ChromeのGeminiに技術的な文章の説明や複数のタブにまたがる情報の比較を頼み、その結果をどう使うかを人が決めます。もう一方の端には、動画を見ることや家の見た目を確かめることのように、人が自分で体験したいことがあります。
このプロダクト責任者は、作業の始まりと終わりの両方で人の判断が重要だと主張します。人が目標と制約を定め、結果を評価するということです。ブラウザーが単なるエージェント用の見えない実行環境になる必要がない理由もここにあります。調査の一部はバックグラウンドで進められますが、ほかの作業では、エージェントが別のタブを扱う間に人が1つのタブを操作する必要があります。
両責任者によれば、ブラウザー利用時間の約40%は動画の視聴に費やされています。この推計は、すべての閲覧が要約で置き換えられる情報検索ではないという、より大きな論点を裏付けます。閲覧には、見た目の評価、論評、個人の好みも関わります。
エージェントにページをより明確に見せる
エージェントがブラウザー内で役立つには、ページに何があるかを使える形で把握する必要があります。Chromeのエンジニアリング責任者が説明するのは、ブラウザーのレイアウトツリーから抽出した要約表現であるannotated page contentです。レイアウトツリーは、ページに描画された要素とその空間的な関係を記録したものです。Chromeはこれを使い、モデルに生のページコードや画像だけを渡すのではなく、見えているコンテンツ、フォームの状態、操作できる要素を伝えられます。
この方法は、開発者がAIのためにすべてのページを作り直さなくても、エージェントが既存のサイトで作業できるようにすることを狙っています。また、エージェントにスクリーンショットを繰り返し確認させ、どこをクリックすべきか推測させるやり方とも異なります。視覚的な操作を使うエージェントは原理的には幅広いインターフェースを扱えますが、その方法は遅く、多くの計算資源を使い、壊れやすい場合があります。

▲ エージェント向けの構造化されたページ情報
Web MCP(Web Model Context Protocolの略)は、もうひとつの道を示します。Webサイトは、エージェントが呼び出せる関数を一覧にしたファイルであるマニフェストを通じて、利用できる操作を平易な英語で記述できます。エージェントはボタンの座標を割り出す代わりに、公開されたページの関数を直接使えます。Chrome DevToolsは、開発者がこうしたマニフェストを確認し、生成するのを支援します。
Chromeの責任者たちは、Web MCPを負担の大きい2つの選択肢の間に位置づけています。ひとつはあらゆる操作でエージェントに視覚的なインターフェースをたどらせること、もうひとつはエージェント向けに独自のAPIを別途維持することです。Web MCPは初期のテストプログラムであるOrigin Trialの段階にあり、約3,200の参加者が登録しています。どの操作を公開するかは引き続き開発者が選び、エージェント専用の別サイトを作る必要はありません。
重要な手順は見える場所に置く
ショッピングの作業は、こうした役割がどう組み合わさるかを示しています。エージェントが商品を検索して17点のカートを組み立て、人が中身を確認して最終的な支払いを決めることができます。同様に、エージェントが外部の予約ページの空き時間と人のカレンダーを照合すれば、人が選択を確かめる余地を残したまま、手作業での画面移動を減らせます。

▲ 購入前の人による確認
Chromeのプロダクト責任者は、任せるかどうかを2つの軸で判断することを提案しています。操作の重大さと、それを実行するモデルの実証された能力です。低額の買い物には、金融取引などの重大な作業と同じ厳しい確認は必要ありません。信頼は、エージェントに独自の行動を一律に認める決定によってではなく、作業ごとに少しずつ築かれていく可能性があります。
インターフェースはその判断を支えられます。エージェントは行動の前に不足している情報を尋ね、段階的な計画を示すことで、取り消せない手順の前にユーザーが何が起きるかを確認できるようにします。違いは単に自動化か手動の閲覧かではなく、バックグラウンドで進めてよい操作と、確認ポイントを設けるべき判断の違いです。
人とエージェントのためのひとつのWeb
エンジニアリングとプロダクトの責任者は、ソフトウェアエージェント向けに別のWebを作るのではなく、人向けの既存サイトを適応させる方向を支持しています。サイトは人にグラフや説明などの視覚的な情報を見せながら、エージェントには構造化されたデータと選ばれた操作を公開する必要があるかもしれません。どちらのアクセス方法も同じ作業に役立ち、判断や承認が必要なときには人がページに戻ります。
Chromeは、ユーザーのデバイス上で行える作業のために、ブラウザーレベルのAIツールも開発しています。Web Embeddingsはテキストを数値表現に変換し、正確な語句ではなく意味による検索を可能にします。想定される用途には、ローカルの文書やメールの検索が含まれます。デバイス上での処理によって、繰り返し発生するクラウドでの推論費用を避け、機密性の高い情報をユーザーのマシンに留められます。こうした開発者向けの機能は、人が結果を確認する目に見えるブラウザーを置き換えるのではなく、補完するものです。
ユーザーと開発者にとって変わること
これから現れるブラウザーは、完全に自律した働き手でも、Webサイトをのぞく単なる窓でもありません。エージェントにページの文脈と定義された操作を提供しながら、人が選択する場所を守ることができます。
ユーザーにとって有益な習慣は、制約を明確に伝え、複数の手順からなる作業ではエージェントの計画を確認し、重大な操作の最終確認を自分で行うことです。Web開発者にとって当面の問いは、既存サイトのどの機能をエージェントが見つけて使えるようにすべきか、そしてどこで人に操作を戻す設計にすべきかです。