Skip to main content
モデルが抽出、要約、分類を行う前に、ワークフローで1ページを取得して長さを制限したテキストにする必要がある場合に、このレシピを使います。

1. phaseo:web_fetchで1ページの内容を根拠にする

phaseo:web_fetchはGatewayが管理するサーバーツールです。 次の用途に適しています。
  • GatewayによるURLの直接取得
  • 上限付きテキストのツールループへの返却
  • リクエスト単位の使用状況の追跡
  • リクエストログでの取得ページの確認
URLが分かっている場合は、広範な検索よりこちらが適しています。

2. リクエストを具体的にする

基本的な流れ:
  1. モデルにphaseo:web_fetchの呼び出しを指示する
  2. Gatewayにページの取得と正規化を任せる
  3. 返されたテキストを使ってモデルに抽出を続けさせる
取得後に行う最終タスクをプロンプトに明記します。
  • フィールドを抽出する
  • 特定のセクションを要約する
  • ドキュメントを分類する
  • 主張を検証する

3. 取得サイズを意図的に制限する

タスクに対して既定の上限が大きすぎる、または小さすぎる場合はmax_charsを指定します。 推奨パターン:
  • タイトルや要約の抽出には小さな上限
  • 構造化フィールドの抽出には大きな上限
ページが非常に大きい場合、取得サイズを無制限にするのではなく、抽出タスクを絞り込みます。

4. 最終回答だけでなくログも確認する

リクエストの詳細には次の情報が表示されます。
  • 取得したURL
  • リダイレクト後の最終URL
  • 利用可能な場合はページタイトル
  • HTTPステータス
  • コンテンツタイプ
  • 返された文字数
  • 切り詰めの有無
この画面で、モデルが想定したページを根拠に回答したことを確認します。

5. ツールの制限を把握する

phaseo:web_fetchは意図的に取得範囲を制限しています。 次の用途に適しています。
  • HTMLページ
  • プレーンテキスト
  • 簡単なJSONまたはXMLレスポンス
次の用途には適していません。
  • バイナリファイル
  • 大規模なクロール
  • JavaScriptのみで描画されるページの確認
ブラウザーで描画された内容を検証する場合は、取得したテキストだけに頼らずブラウザーのワークフローを使います。

6. 推奨する導入手順

  1. 1つのプリセットまたはエンドポイントパスから始める
  2. リクエストログで取得メタデータと切り詰めを確認する
  3. 取得内容が広すぎる場合はプロンプトの範囲を絞る
  4. 根拠に基づく抽出が安定してから範囲を広げる

関連項目

最終更新日 2026年10月2日