MCP で AI アシスタントを接続する
Browser.lol の MCP サーバーを使うと、AI アシスタントからクラウド上のブラウザを操作できます。クライアントの接続方法、使えるツール、セッションとアクセス権の扱いを説明します。
クライアントにサーバーを追加する
Claude Codeを接続
ツールを利用できるモデルとClaude Codeの最新バージョンを使用してください。
接続を追加
ターミナルで実行したら、Claude Code で /mcp と入力し、browserlol を選んでログインしてください。
ターミナルで実行
claude mcp add --scope user --transport http browserlol https://api.browser.lol/mcpログインしてアクセスを許可
アシスタントがBrowser.lolを開きます。使用するアカウントでログインし、アクセスを許可してからアシスタントに戻ってください。
/mcpbrowserlolAuthenticate
新しいチャットで試す
アシスタントでサーバーとツールを有効にし、以下の指示を送信してください。
/mcp
Browser.lol のセッションで example.com を開き、ページの内容を教えてください。
必要なもの
MCP (Model Context Protocol) は、アシスタントが外部のツールを使うための仕組みです。Browser.lol に接続すると、クラウド上のブラウザを人間のように操作できます。実際のマウスとキーボードの入力を人間らしいタイミングで送るため、サイトからは自動化ではなく人が操作しているように見えます。ページを開いて読み取ったり、操作したり、ファイルをアップロードしたり、画面全体を撮影したりできます。利用できるブラウザイメージと通信の出口は、アカウントによって異なります。
ブラウザは当社のインフラ上で動くため、ブラウザドライバーをインストールする必要はありません。一方、MCP クライアントは設定した環境で動きます。セッションとライブビューは当社が提供し、AI モデルはクライアント側で利用します。
必要なもの
- エンドポイント
- https://api.browser.lol/mcp
- トランスポート
- Streamable HTTP(リクエストごとにステートレス)
- 認証
- ブラウザでの OAuth ログイン、または自動化向けにヘッダーで送る API キー
- プラン
- プログラムによるアクセスが可能なアカウント(Premium に含まれます)
- ブラウザ
- プログラムでの利用向けに指定され、アカウントで使えるイメージ。既定は Chrome
アシスタントが使えるツール
browser_* ツールはブラウザを人間のように操作します。クリック、キー入力、スクロールはすべて、人間らしいタイミングで送られる実際のマウスとキーボードの入力なので、サイトからは自動化ではなく人が操作しているように見えます。browser_navigate から始めると、必要に応じてセッションを開き、アクセシビリティスナップショットを取得できます。その要素参照はページ操作ツールで使います。browser_screenshot は常に画面全体を撮影し、その画像のピクセルが browser_click、browser_hover、browser_drag、browser_scroll の座標になります。
セッションとアカウント
画面サイズ、言語、キーボード配列を指定してセッションを開始し、一覧表示、名前の変更、終了、通信の出口の変更ができます。アカウント情報の確認や設定の変更、登録用リンクやコードを受け取る一時メールの受信箱の確認も可能です。ログインや CAPTCHA では、エージェントが browser_ask_user で見ている人に助けを求めます。
- browser_session_create
- browser_session_list
- browser_session_update
- browser_session_close
- browser_account
- browser_account_update
- browser_mail
- browser_ask_user
ナビゲーション
URL を開き、戻る・進む・再読み込みを行い、複数のタブで作業します。
- browser_navigate
- browser_tabs
読み取りとスクリーンショット
ダイアログを先頭に並べたアクセシビリティスナップショットの取得、ページ内検索、テキストや URL の変化・一定時間の待機、コンソールとネットワークの情報の確認、Cookie とストレージの読み取りができます。ブラウザのツールバーやメニュー、システムのダイアログを含む画面全体も撮影できます。
- browser_snapshot
- browser_find
- browser_screenshot
- browser_wait_for
- browser_devtools
操作
要素参照、または browser_screenshot の画面座標を使って、クリック、入力、フォームへの記入、選択、スクロールができます。参照を指定しない入力は、アドレスバーを含め、キーボードフォーカスのある場所に送られます。キー操作は JavaScript のダイアログにも Enter や Escape で応答します。
- browser_click
- browser_type
- browser_fill_form
- browser_select_option
- browser_press_key
- browser_scroll
- browser_hover
- browser_drag
ファイル
ページのファイル入力欄からアップロードし、セッションがダウンロードしたファイルを取得できます。
- browser_file_upload
- browser_downloads
セッションの挙動
- ページ操作ツールからセッションを開始できます。 アカウントに稼働中のセッションがない場合、ページ操作ツールがセッションを作成できます。複数ある場合は、操作するセッションの ID を指定してください。
- セッションには時間制限があります。 プランで定められた無操作時間や最長利用時間に達すると、セッションは終了する場合があります。手動で終了して利用枠を空けることもできます。
- 利用者とアシスタントはセッションを共有します。 アシスタントはアプリで開始したセッションを一覧表示して利用できます。保存済みプロフィールを使うセッションも対象です。アシスタントが開始したセッションはライブビューから確認・管理できます。保存済みプロフィールへの変更は残る場合があります。
- アクセスは認証したアカウントに限られます。 ツールでアクセスできるのは、認証したアカウントのセッションのうち、そのアカウントに利用権限があるものです。
- プログラム経由のアクセス権が必要です。 アカウントにプログラム経由のアクセス権がない場合、MCP のアクセス判定で HTTP 403 が返されます。Premium にはこの機能が含まれます。
セキュリティ
- 接続済みアプリと API キーは、パスワードと同じようにアカウントの権限で動作します。使わなくなったら、すぐに「エージェント」ページでアプリの接続を解除するか、キーを取り消してください。
- API キーは Authorization または x-api-key ヘッダーで送信してください。アドレスはログやブラウザの履歴に残るため、URL に含めたキーは受け付けません。
- ページはリモートのブラウザコンテナで読み込まれます。エージェントは保存済みプロファイル付きのセッションも使えます。その場合、変更内容が残ることがあります。
- 操作は自動で切り替わります。アシスタントの操作がブラウザを動かし、その様子をライブビューで確認できます。ライブビューのボタンで操作を引き取ると、その間アシスタントは一時停止し、操作は待機して再試行までの時間とともに user_in_control を返します。読み取りはそのまま使えます。操作を戻すと、アシスタントが作業を再開します。