1. ワークスペースにガードレールを作成する
複数のキーで同じポリシーを再利用できるように、まずワークスペースレベルでガードレールを作成します。 最初の設定では次をおすすめします。- コンテンツチェックより先にモデルとプロバイダーを制限する
- 最初の展開は 1 つのキーまたは環境に絞る
- チーム名ではなく、ポリシーの結果を表す名前を付ける
2. 対象の API キーに関連付ける
API キーの設定ページで、ポリシーを適用するキーにガードレールを関連付けます。 次の順で進めます。- ステージング用またはリスクの低いキーから始めます。
- 可能であれば、一度に 1 つのガードレールだけを関連付けます。
- キーの詳細ダイアログに適用済みガードレールが表示されることを確認します。
3. 予算ポリシーとルーティング制限を設定する
よく使われる組み合わせは次のとおりです。- 1 日のコスト上限
- 信頼度の低いプロバイダーのブロックリスト
- ルーティングを維持する対象の本番モデルを指定した許可リスト
- 許可されたままのプロバイダー
- ブロックされるモデル
Only allowが意図以上に範囲を狭めていないか
4. プロンプトインジェクションと機密情報のルールを追加する
現実的な展開では次のようにします。- プロンプトインジェクションには
flagまたはredactから始める - 偽陽性を確認してから
blockに変更する - 機密情報には、まず次の決定的なルールを使用する
- メールアドレス
- 電話番号
- SSN
- クレジットカード
- IP アドレス
5. 広く展開する前にポリシーをテストする
ガードレールのプレビューで次を試します。- 問題のない入力
- 明らかに許可されない入力
- 本番に近い現実的なプロンプト
- マスキングテキストが正しい
- ブロックと許可の動作が正しい
- 関係のないコンテンツを誤って検出しない
6. アクティビティとログで適用状況を確認する
保護対象のキーから実際のリクエストを送信した後、次を確認します。- アクティビティページの ガードレールの適用 パネル
- ブロックまたはマスキングされたリクエストの詳細ダイアログ
- API キー詳細ダイアログのキーごとのガードレールアクティビティ
- ブロックされた件数
- マスキングされた件数
- フラグが付いた件数
- ルールが適用された際のガードレールと検出器の詳細
7. 安全に展開範囲を広げる
最初のキーが正しく動作したら、次の手順に進みます。- 同じガードレールを他のキーにも関連付けます。
- アクションを
flagからredactまたはblockへ段階的に強化します。 - レイテンシーが増えても許容できる場所だけで、名前と住所の高レイテンシー検出を追加します。