Skip to main content
Métodos: client.generate_text(...), client.create_chat_completion(...).

Ejemplo

Parámetros principales

  • model (obligatorio): ID del modelo de destino.
  • messages (obligatorio): mensajes ordenados con los roles user/system/assistant/tool; el contenido se expresa como texto.
  • Muestreo: temperature (0–2), top_p (0–1), top_k (>=1), seed (entero, opcional).
  • Longitud y penalizaciones: max_output_tokens (entero), presence_penalty y frequency_penalty (-2 a 2), stop (cadena o matriz de cadenas).
  • Herramientas: tools (definiciones), tool_choice (automática/ninguna/herramienta específica), max_tool_calls (entero), parallel_tool_calls (booleano).
  • Probabilidades logarítmicas: logprobs (booleano), top_logprobs (0–20).
  • Salida: response_format (json/text), metadata (objeto transferido sin cambios), stream (booleano), service_tier.
  • Opciones adicionales del gateway: usage (booleano para solicitar el uso), meta (booleano para incluir el bloque meta).

Valor devuelto

ChatCompletionsResponse
Última modificación el 2 de octubre de 2026