Skip to main content
Nutze diesen Leitfaden für eine von drei Fragen: Ist Phaseo verfügbar, lässt sich ein Modell jetzt routen oder erfüllt eine Route das Zuverlässigkeitsziel deiner Anwendung?

Aktuellen Servicestatus prüfen

  1. Öffne die Phaseo-Statusseite, um aktuelle Vorfälle und den bisherigen Verlauf zu sehen.
  2. Rufe GET /v1/health für eine einfache Gateway-Statusprüfung.
  3. Wenn eine Anfrage fehlschlägt, notiere ihre Request-ID und prüfe Aktivität oder Generierungsdatensatz, bevor du von einem vollständigen Dienstausfall ausgehst.
Die öffentliche Statusseite meldet den Servicestatus. Phaseo beansprucht derzeit keine vertragliche öffentliche Verfügbarkeits-SLA.

Prüfen, ob ein Modell geroutet werden kann

Der Phaseo-Katalog umfasst mehr Modelle als über das Gateway verfügbar sind. Dass ein Modell im Katalog aufgeführt ist, bedeutet, dass Phaseo es erfasst, nicht dass eine öffentliche Route existiert. GET /v1/models gibt standardmäßig nur aktuell routbare Modelle zurück:
Verwende availability=all nur, wenn du gezielt geplante oder inaktive Zuordnungen prüfen möchtest. Sende keinen Produktionsverkehr an einen Provider-Eintrag, es sei denn, availability_status lautet active und is_active_gateway lautet true. Verfügbarkeit garantiert weder dauerhafte Betriebszeit noch Zugang in jeder Region oder identische Geschäftsbedingungen für alle Workspaces.

Leistungsmetriken interpretieren

Die Performance-Daten von Phaseo sind Beobachtungsdaten: Sie fassen über das Gateway geleitete Anfragen zusammen und stammen nicht aus einem kontrollierten Labortest. TTFT und Ausgabegeschwindigkeit erfordern eine Streaming-Antwort mit einer ersten Ausgabe, die Inhalt enthält. Eine Anfrage ohne Streaming kann weiterhin Dauer und effektiven Durchsatz beitragen, ohne dass ein TTFT erfunden wird. Betrachte eine Metrik immer zusammen mit Zeitfenster, Route, Region, Streaming-Modus und Perzentil. Provider-Auslastung, Prompt- und Ausgabelänge, Wiederholungen sowie Transportbedingungen können das Ergebnis verändern. Die vollständigen Definitionen findest du unter Preise und Leistung und Wie Phaseo Latenz und Durchsatz misst.

Mit deiner Arbeitslast validieren

Öffentliche Telemetrie liefert Hinweise, beweist aber nicht, dass eine Route dein Produktionsziel erfüllt. Führe vor dem Rollout eine kleine, reproduzierbare Untersuchung durch:
  1. Entferne sensible Produktionsdaten und verwende eine repräsentative Prompt-Mischung.
  2. Halte Modell-ID, Endpoint, Provider-Einschränkungen, Region, Streaming-Modus und Parallelität fest.
  3. Führe genügend Wiederholungen aus, um Verteilungen statt einzelner Anfragen zu vergleichen.
  4. Erfasse Erfolgsrate, Gateway-TTFT, Provider-Dauer, Gateway-E2E, Ausgabetokens und Endkosten.
  5. Teste ungültige Schlüssel und Modelle, Ratenlimits und Fehler bei nicht verfügbaren Providern.
  6. Speichere Request-IDs und das genaue Zeitfenster, damit andere das Ergebnis reproduzieren können.
Veröffentliche Kundennamen, Zitate, Arbeitslastergebnisse oder Zuverlässigkeitswerte nur mit Genehmigung und einer dokumentierten Methode.

Fehlgeschlagene Anfrage untersuchen

  • Prüfe den Servicestatus.
  • Prüfe, ob das Modell weiterhin in der Standardantwort von GET /v1/models erscheint.
  • Prüfe den HTTP-Status und Fehlercode unter Fehlerbehandlung.
  • Wiederhole vorübergehende Fehler 429 und 5xx mit begrenztem exponentiellem Backoff.
  • Notiere die Request-ID, wenn du den Support kontaktierst.

Verwandte Anleitungen

Zuletzt geändert am 2. Oktober 2026