Skip to main content

概要

Browser Use Sandbox ツールは、オープンソースの browser-use フレームワークをセキュアなE2Bサンドボックス内で実行します。自然言語でやりたいことを記述するだけで、AIエージェントがWebサイトのナビゲーション・フォーム入力・データ抽出などを自動で行います。OpenAIモデルで動作します。 Human-in-the-Loopワークフローでは、keep_session: true を設定するとタスク完了後に一時停止し、sandbox_id が返されます。その sandbox_id を次の BROWSER_USE_SANDBOX_RUN_TASK ステップに渡すことで、同じブラウザセッションに再接続してタスクを続行できます。

設定

入力

クレジット消費

openai_api_key が空の場合、このステップはステップあたりの定額ではなく、選択した llm_model のレートでトークン単位のJinbaクレジットが課金されます。自分のAPIキーを指定した場合はOpenAIに直接課金されるため、クレジットは消費しません。
  • 実行前に、max_steps × ブラウザ1ステップあたりの想定トークン数(各ステップでページのDOMと実行履歴を送り直します)を、そのモデルのレートで換算した分が予約されます。この予約額は実行可否の判定も兼ねており、残高が予約額に満たない場合はサンドボックスが起動する前にステップが失敗します。
  • 実行後に、予約額はエージェントが実際に報告したトークン使用量に置き換えられます。タスクが成功しても失敗しても同じです。max_steps: 100 の上限がかかるのは予約額だけで、最終的な課金額は実使用量に従います。
  • 使用量がまったく報告されずに終了した実行は、一律160クレジットです。
  • リストに対して繰り返し実行するステップ(forEach)は、上記2つのルールのいずれにも当てはまりません。 集約された出力には使用量が一切含まれないため、実行前に予約した額がそのまま課金されます。繰り返し回数がいくつであっても、各回が報告したトークンで再計算されることも、一律160クレジットに引き下げられることもありません。forEach を使うブラウザ操作ステップは、下表の予約額で見積もってください。
モデルと max_steps ごとの予約額: どの実行でも予約額の下限は160クレジットです。そのため max_steps を大きくすると、数ステップで終わるタスクであっても実行前に必要な残高が増えます。

出力

files[]

ファイルが黙って消えることはありません。 持ち出せなかった場合は url の代わりに error が入ります。理由は、1ファイル10MB超過・実行全体で20MB超過・21件目以降・エージェント停止時にダウンロード未完了・拡張子が対象外、のいずれかです。 対応拡張子: csv, html, json, txt, xml, yaml, yml, md, tsv, log, sql, xls, xlsx, pdf, docx, pptx, png, svg, jpg, jpeg, gif, webp

エージェントに見せずに秘匿値を入力させる

task の中に <secret>MY_SECRET</secret> と書きます。MY_SECRET はワークスペースシークレットの名前です。エージェントもLLMもプレースホルダしか見ず、実値はブラウザへ入力する直前だけ復元されます。ステップ出力には値ではなく Typed sensitive data が記録されます。
task に {{secrets.MY_SECRET}} と書かないでください。 ステップ実行前に展開されるため、値がステップの入力に記録されLLMにも送られます。検出した場合は ConfigurationError でステップが失敗します。この挙動が入る前に同じ書き方で動いていたフローも失敗します。
使えるのはワークスペースシークレットと組織シークレットのみです。個人(ユーザー)シークレットはこのツールからは参照できません。シークレットはエージェントに紐づき、サイトには紐づきません。browser-use はエージェントが到達したページであれば入力します。訪問先を限定したタスクを書き、影響範囲を許容できる認証情報を使ってください。

使用例 — シンプルなタスク

使用例 — Human-in-the-Loopフォーム送信