Vérifier l’état actuel du service
- Ouvrez la page d’état de Phaseo pour consulter les incidents en cours et leur historique.
- Appelez
GET /v1/healthpour effectuer une vérification minimale de l’état du gateway. - Si une requête échoue, conservez son ID et examinez l’activité ou l’enregistrement de génération avant de conclure que tout le service est indisponible.
La page d’état publique indique la santé du service. Phaseo ne revendique actuellement aucun SLA contractuel public de disponibilité.
Vérifier qu’un modèle peut être routé
Le catalogue Phaseo est plus vaste que l’ensemble des modèles accessibles via le gateway. La présence d’un modèle signifie que Phaseo le répertorie, pas qu’une route publique existe.GET /v1/models ne renvoie par défaut que les modèles actuellement routables :
availability=all uniquement si vous souhaitez examiner les associations à venir ou inactives. N’envoyez pas de trafic de production vers une ligne de fournisseur sauf si availability_status vaut active et is_active_gateway vaut true.
La disponibilité ne garantit ni un temps de fonctionnement permanent, ni l’accès dans toutes les régions, ni des conditions commerciales identiques pour tous les workspaces.
Interpréter les métriques de performance
Les données de performance de Phaseo sont observationnelles : elles résument les requêtes acheminées par Gateway, et non les résultats d’un benchmark contrôlé en laboratoire.
Le TTFT et la vitesse de sortie nécessitent une réponse en streaming dont la première sortie contient du contenu. Une requête sans streaming peut tout de même contribuer aux mesures de durée et de débit effectif, sans TTFT artificiel.
Interprétez toujours une métrique avec sa période, sa route, sa région, son mode de streaming et son percentile. La charge du fournisseur, la longueur du prompt et de la sortie, les nouvelles tentatives et les conditions de transport peuvent modifier le résultat.
Pour les définitions complètes, consultez Tarifs et performances et Comment Phaseo mesure la latence et le débit.
Valider avec votre charge de travail
La télémétrie publique fournit des indications, mais ne prouve pas qu’une route respecte votre objectif de production. Réalisez une étude réduite et reproductible avant le déploiement :- Supprimez les données de production sensibles et conservez un échantillon représentatif de prompts.
- Notez l’ID du modèle, l’endpoint, les contraintes fournisseur, la région, le mode de streaming et la concurrence.
- Effectuez suffisamment de répétitions pour comparer des distributions plutôt qu’une seule requête.
- Mesurez le taux de réussite, le TTFT du gateway, la durée du fournisseur, la durée E2E du gateway, les jetons de sortie et le coût final.
- Testez les clés et modèles invalides, les limites de débit et les erreurs liées à un fournisseur indisponible.
- Enregistrez les ID de requête et la période exacte afin qu’un autre ingénieur puisse reproduire le résultat.
Diagnostiquer une requête échouée
- Consultez l’état du service.
- Vérifiez que le modèle apparaît toujours dans la réponse par défaut de
GET /v1/models. - Consultez le statut HTTP et le code d’erreur dans Gestion des erreurs.
- Réessayez les erreurs transitoires
429et5xxavec un délai exponentiel limité. - Notez l’ID de requête avant de contacter le support.