Skip to main content
Método: client.generateResponse() (transmita blocos processados com client.streamResponses()).

Exemplo

Transmissão em fluxo

Parâmetros principais

  • model (required): ID do modelo de destino.
  • input (required): Array ordenado de itens de entrada (mensagens, chamadas de ferramentas etc.).
  • temperature (0-2): Quanto maior, mais aleatório.
  • top_p (0-1) / top_k (>=1): Controles de amostragem nucleus / k-best.
  • max_output_tokens (int): Limite máximo de tokens gerados por resposta.
  • Ferramentas: tools (definições), tool_choice (auto/none/específico), max_tool_calls (int), parallel_tool_calls (bool).
  • Logprobs: logprobs (bool), top_logprobs (0-20) para retornar os logprobs de cada token.
  • Saída: response_format (json/text), service_tier, store (bool), stream (bool).
  • Metadados: metadata (object) para repasse sem alterações, reasoning (object) para indicar o nível de esforço.
  • Opções adicionais do Gateway: usage (bool para solicitar uso), meta (bool para incluir o bloco meta).

Retorno

ResponsesResponse
Ou quadros SSE delimitados por linha quando stream: true:
Última modificação em 2 de outubro de 2026