Aktuellen Servicestatus prüfen
- Öffne die Phaseo-Statusseite, um aktuelle Vorfälle und den bisherigen Verlauf zu sehen.
- Rufe
GET /v1/healthfür eine einfache Gateway-Statusprüfung. - Wenn eine Anfrage fehlschlägt, notiere ihre Request-ID und prüfe Aktivität oder Generierungsdatensatz, bevor du von einem vollständigen Dienstausfall ausgehst.
Die öffentliche Statusseite meldet den Servicestatus. Phaseo beansprucht derzeit keine vertragliche öffentliche Verfügbarkeits-SLA.
Prüfen, ob ein Modell geroutet werden kann
Der Phaseo-Katalog umfasst mehr Modelle als über das Gateway verfügbar sind. Dass ein Modell im Katalog aufgeführt ist, bedeutet, dass Phaseo es erfasst, nicht dass eine öffentliche Route existiert.GET /v1/models gibt standardmäßig nur aktuell routbare Modelle zurück:
availability=all nur, wenn du gezielt geplante oder inaktive Zuordnungen prüfen möchtest. Sende keinen Produktionsverkehr an einen Provider-Eintrag, es sei denn, availability_status lautet active und is_active_gateway lautet true.
Verfügbarkeit garantiert weder dauerhafte Betriebszeit noch Zugang in jeder Region oder identische Geschäftsbedingungen für alle Workspaces.
Leistungsmetriken interpretieren
Die Performance-Daten von Phaseo sind Beobachtungsdaten: Sie fassen über das Gateway geleitete Anfragen zusammen und stammen nicht aus einem kontrollierten Labortest.
TTFT und Ausgabegeschwindigkeit erfordern eine Streaming-Antwort mit einer ersten Ausgabe, die Inhalt enthält. Eine Anfrage ohne Streaming kann weiterhin Dauer und effektiven Durchsatz beitragen, ohne dass ein TTFT erfunden wird.
Betrachte eine Metrik immer zusammen mit Zeitfenster, Route, Region, Streaming-Modus und Perzentil. Provider-Auslastung, Prompt- und Ausgabelänge, Wiederholungen sowie Transportbedingungen können das Ergebnis verändern.
Die vollständigen Definitionen findest du unter Preise und Leistung und Wie Phaseo Latenz und Durchsatz misst.
Mit deiner Arbeitslast validieren
Öffentliche Telemetrie liefert Hinweise, beweist aber nicht, dass eine Route dein Produktionsziel erfüllt. Führe vor dem Rollout eine kleine, reproduzierbare Untersuchung durch:- Entferne sensible Produktionsdaten und verwende eine repräsentative Prompt-Mischung.
- Halte Modell-ID, Endpoint, Provider-Einschränkungen, Region, Streaming-Modus und Parallelität fest.
- Führe genügend Wiederholungen aus, um Verteilungen statt einzelner Anfragen zu vergleichen.
- Erfasse Erfolgsrate, Gateway-TTFT, Provider-Dauer, Gateway-E2E, Ausgabetokens und Endkosten.
- Teste ungültige Schlüssel und Modelle, Ratenlimits und Fehler bei nicht verfügbaren Providern.
- Speichere Request-IDs und das genaue Zeitfenster, damit andere das Ergebnis reproduzieren können.
Fehlgeschlagene Anfrage untersuchen
- Prüfe den Servicestatus.
- Prüfe, ob das Modell weiterhin in der Standardantwort von
GET /v1/modelserscheint. - Prüfe den HTTP-Status und Fehlercode unter Fehlerbehandlung.
- Wiederhole vorübergehende Fehler
429und5xxmit begrenztem exponentiellem Backoff. - Notiere die Request-ID, wenn du den Support kontaktierst.