1. Créer le garde-fou dans l’espace de travail
Créez d’abord les garde-fous au niveau de l’espace de travail afin de pouvoir réutiliser la même politique sur plusieurs clés. Pour commencer :- ajoutez les restrictions de modèles et de fournisseurs avant les contrôles de contenu
- limitez le premier déploiement à une seule clé ou à un seul environnement
- choisissez un nom qui décrit le résultat de la politique, pas le nom de l’équipe
2. Associer le garde-fou à une clé d’API
Dans les paramètres de la clé d’API, associez le garde-fou à la clé qui doit appliquer la politique. Procédez dans cet ordre :- commencez par une clé de test ou à faible risque
- si possible, associez un seul garde-fou à la fois
- vérifiez que la fenêtre des détails de la clé affiche le garde-fou appliqué
3. Définir la politique de budget et les restrictions de routage
Combinaison courante :- limite de coût quotidienne
- liste de blocage des fournisseurs considérés comme peu fiables
- liste d’autorisation des modèles exacts de production qui doivent rester routables
- quels fournisseurs restent autorisés
- quels modèles sont bloqués
- si
Only allowrestreint davantage que prévu
4. Ajouter des règles contre l’injection de prompt et sur les informations sensibles
Pour un déploiement pratique :- commencez par
flagouredactpour l’injection de prompt - passez à
blockuniquement après avoir examiné les faux positifs - utilisez d’abord des règles déterministes pour les informations sensibles :
- adresse e-mail
- numéro de téléphone
- numéro de sécurité sociale américain (SSN)
- carte de crédit
- adresse IP
5. Tester la politique avant un déploiement à grande échelle
Dans l’aperçu du garde-fou, testez :- une entrée sans risque
- une entrée clairement interdite
- un prompt réaliste, proche de ceux utilisés en production
- le texte de masquage attendu
- le comportement de blocage et d’autorisation
- l’absence de détection accidentelle dans du contenu sans rapport
6. Vérifier l’application dans l’activité et les journaux
Après avoir envoyé de vraies requêtes avec la clé protégée, vérifiez :- le panneau Application des garde-fous sur la page d’activité
- les fenêtres de détail des requêtes bloquées ou dont le contenu a été masqué
- l’activité des garde-fous par clé dans la fenêtre des détails de la clé d’API
- le nombre de blocages
- le nombre de contenus masqués
- le nombre d’alertes
- les détails du garde-fou et du détecteur concernés lorsqu’une règle s’est appliquée
7. Étendre le déploiement en toute sécurité
Lorsque la première clé fonctionne comme prévu :- associez le même garde-fou à d’autres clés
- renforcez les actions de
flagversredactoublock - activez la détection plus lente des noms et des adresses uniquement si le coût en latence est acceptable