Skip to main content
Métodos: client.generate_response(...), client.create_response(...).

Exemplo

Parâmetros principais

  • model (obrigatório): ID do modelo de destino.
  • input (obrigatório): array ordenado de itens de entrada, como mensagens e chamadas de ferramentas.
  • temperature (0–2): quanto maior o valor, maior a aleatoriedade.
  • top_p (0–1) / top_k (>=1): controles de amostragem por núcleo e pelas k melhores opções.
  • max_output_tokens (inteiro): limite rígido de tokens gerados por resposta; use max_output_tokens_per_message para limitar cada mensagem.
  • Ferramentas: tools (definições), tool_choice (automática/nenhuma/específica), max_tool_calls (inteiro), parallel_tool_calls (booleano).
  • Logprobs: logprobs (booleano), top_logprobs (0–20) para retornar as probabilidades logarítmicas de cada token.
  • Saída: response_format (json/text), service_tier, store (booleano), stream (booleano).
  • Metadados: metadata (objeto repassado sem alterações), reasoning (objeto com indicações de esforço).
  • Extras do gateway: usage (booleano para solicitar o uso), meta (booleano para incluir o bloco meta).

Retorno

ResponsesResponse
Última modificação em 2 de outubro de 2026