Verifique o status atual do serviço
- Abra a página de status da Phaseo para consultar os incidentes atuais e o histórico.
- Chame
GET /v1/healthpara fazer uma verificação básica de disponibilidade do Gateway. - Se uma solicitação falhar, guarde o ID dela e inspecione a atividade ou o registro de geração antes de presumir que o serviço inteiro está indisponível.
A página pública de status informa a disponibilidade do serviço. A Phaseo não declara atualmente um SLA público contratual de disponibilidade.
Confirme se um modelo pode ser roteado
O catálogo da Phaseo inclui mais modelos do que os disponíveis pelo Gateway. A presença de um modelo no catálogo significa que a Phaseo o acompanha, não que exista uma rota pública.GET /v1/models retorna apenas modelos roteáveis no momento por padrão:
availability=all somente quando quiser consultar mapeamentos futuros ou inativos. Não envie tráfego de produção para uma linha de provedor, a menos que availability_status seja active e is_active_gateway seja true.
A disponibilidade não garante operação contínua, acesso em todas as regiões nem condições comerciais idênticas para cada workspace.
Interprete métricas de desempenho
Os dados de desempenho da Phaseo são observacionais: resumem as solicitações roteadas pelo Gateway, em vez de resultados de testes controlados em laboratório.
TTFT e velocidade de saída exigem uma resposta em streaming cuja primeira saída contenha conteúdo. Uma solicitação sem streaming ainda pode contribuir com medidas de duração e throughput efetivo, sem inventar um TTFT.
Sempre interprete uma métrica junto com o período, a rota, a região, o modo de streaming e o percentil. A carga do provedor, o tamanho do prompt e da saída, as novas tentativas e as condições de transporte podem alterar o resultado.
Para ver as definições completas, consulte Preços e desempenho e Como a Phaseo mede latência e throughput.
Valide com sua carga de trabalho
A telemetria pública é indicativa, mas não prova que uma rota atende à meta de produção. Faça um estudo pequeno e reproduzível antes da implantação:- Remova dados de produção confidenciais e mantenha uma combinação representativa de prompts.
- Registre o ID do modelo, endpoint, restrições do provedor, região, modo de streaming e concorrência.
- Faça repetições suficientes para comparar distribuições, e não apenas uma solicitação.
- Registre taxa de sucesso, TTFT do Gateway, duração do provedor, E2E do Gateway, tokens de saída e custo final.
- Teste chaves e modelos inválidos, limites de taxa e falhas de provedores indisponíveis.
- Salve os IDs das solicitações e o período exato para que outra pessoa possa reproduzir o resultado.
Investigue uma solicitação com falha
- Consulte o status do serviço.
- Confirme se o modelo ainda aparece na resposta padrão de
GET /v1/models. - Consulte o status HTTP e o código de erro emTratamento de erros.
- Tente novamente os erros transitórios
429e5xxcom recuo exponencial limitado. - Anote o ID da solicitação ao contatar o suporte.