WebMCPを試してみたがまだ時期尚早だった(2026年9月時点)

Web MCP WebMCP
目次

コーディングエージェントを拡張するための規格というのがいくつかあります。まず最初に大流行したModel Context Protocol(MCP)。そしてSkillsは有名です。今回試してみたのがWebMCPです。

WebMCPはW3Cのアンオフィシャルなプロポーザルですが、提出しているのはMicrosoftとGoogleの人です。で、今の所対応してそうなブラウザが、Chromeと、Codexの内蔵ブラウザとのこと。

と言うことで試してみたところ、まだ現時点では実用には程遠そうだな、と言う感想でした。作業メモとして残しておきます。

WebMCP(が一般で使えるようになったら)期待できること

MCPもSkillsもすでに多くの人が使っています。これらのツールは開発者にとってはいつでも使えるものですが、そうではないユーザーからするとコーディングエージェントを必要とするツールです。安ければ$10ぐらいとはいえ、開発者やビジネスでAIを契約しているユーザー以外には使いにくい。

非開発者でCodexやClaude Codeに課金している人はいるかもしれませんし、Microsoft Copilot 365を使っている人もいるかもしれないですが、一般向けWebサービスでMCPをインターフェースにして提供します!までは舵を切ることができるほどではないかと思っています。

こうかも?

一方、WebMCPならば、ブラウザだけがあれば使えるようになるんじゃないかと思ったわけです。生成AIはできることがどんどん増えています。一言言えば80%の完成度のものが10%の時間でできると。とはいえ、残りの20%を期待通りにするのには細かいディレクションが必要でなかなか完成しない、というのが実情かと思います。どうしても言葉では指示しにくいものはGUIツールでディレクションを行う方が良いという場面は多いと思うので、そういったものを実装する土台としてかなり未来を感じたわけですよ。

仕組み

MCPサーバーそのものは以下のような機能を提供しています。

  • ツール: データを加工するなどのメソッド
  • リソース: データアクセスのRead系メソッド
  • プロンプト: ホスト(呼び出し側ツール)に読みこませるプロンプト

一方、WebMCPはMCPサーバーのうちのツールだけに対応しています。それを登録しておきます。

const tools = [
{
name: 'get_project_summary',
title: 'Get project summary',
description: 'Read the current C4 project name, scope, and element counts.',
inputSchema: { type: 'object', properties: {}, additionalProperties: false },
execute: () => ({ project: projectRef.current.name, level: scopeRef.current.level, scope: labelForScope(projectRef.current, scopeRef.current), elementCount: Object.keys(projectRef.current.elements).length }),
},
:
]
// 登録
Promise.all(tools.map((tool) => {
document.modelContext.registerTool(tool, { signal: controller.signal })
}))

こうするとウェブアプリの操作をガシガシAIがやってくれていい感じになる?

というわけで試してみようと思った

試すにはウェブアプリケーションが必要なので、さっとCodexに作ってもらいました。Codex、初期のR大きめの秋色角丸パネルを並べた様なデザインからすると、だいぶ垢抜けた感じのUIを何も言わずに作ってくれる様になりましたね。C4 diagramのモデリングツールです。機能は全然足りていませんが。

Chromeに設定(chrome://flags/#devtools-webmcp-support)があるので有効にしてみました。これで右上のGeminiを開いて操作できたら神!と思ったらどうも登録したツールを見つけてくれない。

WebMCP - Model Context Tool Inspectorと言うツールを入れないといけないらしい。これを入れると確かにツールは出てくるが呼び出しにはAPIキーの登録が必要とのこと・・・それは一般人に使わせるには厳しい・・・

OpenAIのChatGPTアプリのブラウザで開くと、チャットで確かに操作できました。気づいた点は以下の通り。

  • GPT-5.6 Terra, GPT-5.6 Sol, GPT-6-Astraでは利用可能。同じ世代のGPT-5.6 Lunaは非対応
  • WebMCPのツールを使って、と明示して言う必要がある(言わないとツールを見つけてくれない?)
  • 使ってはくれるのだがちょっと応答は遅いかもしれない。普通にComputer Useの方が早い可能性すらある

まとめ

一般の人が使えるブラウザの中からAIを通じて操作ができるようになると、アプリケーションの作り方は変わってくるな、と期待して触ってみたのですが、まだ「いますぐアプリに組み込むべき!」というところには至っていないかな、という感想です。

ただ、将来的にこの様な体験が来るのは間違いないとは思っていて、そのインターフェースがMCPなのかSkillsなのかWebMCPなのか、ブラウザ内蔵AI機能を使ったウェブアプリに組込みのChat Botなのか、ラストワンマイルのアプリとの接合部分はどうなるかなー、と思っています。

今だとアプリ側がAIのAPIを使う、各アプリがエージェントを実装するというのが一般的だと思いますが、アプリごとにデスクトップアプリを作っていた時代に近く、ユーザーが選んだブラウザなどのツールが常に媒介するのはウェブ化と同じような進化だと思うので、将来的にはこのような世界になっていくと思います。

今後も定期的にアップデートをウォッチしていきたいなと思っています。