Skip to main content
Métodos: client.generate_response(...), client.create_response(...).

Ejemplo

Parámetros principales

  • model (obligatorio): ID del modelo de destino.
  • input (obligatorio): matriz ordenada de elementos de entrada, como mensajes y llamadas a herramientas.
  • temperature (0–2): cuanto más alto, mayor aleatoriedad.
  • top_p (0–1) / top_k (>=1): controles de muestreo por núcleo y por k mejores opciones.
  • max_output_tokens (entero): límite estricto de tokens generados por respuesta; usa max_output_tokens_per_message para limitar cada mensaje.
  • Herramientas: tools (definiciones), tool_choice (automática/ninguna/específica), max_tool_calls (entero), parallel_tool_calls (booleano).
  • Logprobs: logprobs (booleano), top_logprobs (0–20) para devolver las probabilidades logarítmicas de cada token.
  • Salida: response_format (json/text), service_tier, store (booleano), stream (booleano).
  • Metadatos: metadata (objeto de transferencia directa), reasoning (objeto con parámetros de esfuerzo).
  • Opciones adicionales del gateway: usage (booleano para solicitar el uso), meta (booleano para incluir el bloque meta).

Valor devuelto

ResponsesResponse
Última modificación el 2 de octubre de 2026