Skip to main content
Método: client.generateResponse() (transmite fragmentos procesados con client.streamResponses()).

Ejemplo

Transmisión en streaming

Parámetros principales

  • model (required): ID del modelo de destino.
  • input (required): Matriz ordenada de elementos de entrada (mensajes, llamadas a herramientas, etc.).
  • temperature (0-2): Un valor mayor genera más aleatoriedad.
  • top_p (0-1) / top_k (>=1): Controles de muestreo de núcleo / k-mejores.
  • max_output_tokens (int): Límite máximo de tokens generados por respuesta.
  • Herramientas: tools (definiciones), tool_choice (auto/none/específico), max_tool_calls (int), parallel_tool_calls (bool).
  • Logprobs: logprobs (bool), top_logprobs (0-20) para devolver los logprobs de cada token.
  • Salida: response_format (json/text), service_tier, store (bool), stream (bool).
  • Metadatos: metadata (object) para transferir datos sin cambios, reasoning (object) para sugerir el nivel de razonamiento.
  • Opciones adicionales de Gateway: usage (bool para solicitar el uso), meta (bool para incluir el bloque meta).

Respuesta

ResponsesResponse
O tramas SSE delimitadas por líneas cuando stream: true:
Última modificación el 2 de octubre de 2026