Métodos: client.generate_text(...), client.create_chat_completion(...).
Exemplo
Parâmetros principais
model (obrigatório): ID do modelo de destino.
messages (obrigatório): mensagens ordenadas com os papéis user/system/assistant/tool; o conteúdo é texto.
- Amostragem:
temperature (0–2), top_p (0–1), top_k (>=1), seed (inteiro, opcional).
- Tamanho e penalidades:
max_output_tokens (inteiro), presence_penalty e frequency_penalty (-2 a 2), stop (string ou array de strings).
- Ferramentas:
tools (definições), tool_choice (automática/nenhuma/ferramenta específica), max_tool_calls (inteiro), parallel_tool_calls (booleano).
- Logprobs:
logprobs (booleano), top_logprobs (0–20).
- Saída:
response_format (json/text), metadata (objeto repassado sem alterações), stream (booleano), service_tier.
- Extras do gateway:
usage (booleano para solicitar o uso), meta (booleano para incluir o bloco meta).
Retorno
ChatCompletionsResponse Última modificação em 2 de outubro de 2026