Objetivo
- manter pequeno o código Python que faz a chamada
- rotear por um slug de predefinição, em vez de fixar um modelo no código
- solicitar uma saída estruturada estrita
- manter metadados de resposta suficientes para depurar o roteamento ou o comportamento dos plugins
1. Comece com um cliente compartilhado
2. Mova os padrões estáveis para uma predefinição
Crie uma predefinição em Painel -> Configurações -> Predefinições quando estes valores precisarem permanecer estáveis entre vários chamadores:- prompt do sistema
- modelo ou lista de modelos permitidos
- preferências de provedores
- configuração de raciocínio
- temperatura e outros parâmetros de geração relacionados
- política de cache de respostas quando a repetição determinística for importante
3. Solicite um formato JSON estrito
presetmantém os padrões de roteamento e de prompt fora do código do aplicativoresponse_formatdeixa o contrato explícitopluginspode recuperar JSON malformado quase válido quando o fluxo permitirmetapreserva detalhes do roteamento e da execução do plugin para depuração
4. Analise o JSON e registre os identificadores operacionais
- a janela de detalhes da requisição no painel
- os diagnósticos de roteamento
- os metadados de execução do plugin
5. Depure antes de substituir configurações
Se uma requisição for roteada de forma diferente do esperado:- abra a requisição em Gateway -> Uso
- confira os diagnósticos de roteamento e os provedores candidatos
- inspecione os metadados de execução dos plugins se houver JSON estruturado
- altere a predefinição somente depois que os logs mostrarem o que aconteceu
6. Mantenha a compatibilidade do cache quando quiser reutilizar resultados
Se a predefinição habilitar o cache de respostas:- mantenha estável o texto do prompt
- mantenha estável o esquema da resposta
- evite substituições desnecessárias de provedor em cada requisição
- evite listas de ferramentas que mudem com frequência