Skip to main content
Método: client.generate_text() (transmite fragmentos procesados con client.stream_chat()).

Ejemplo

Transmisión

Parámetros clave

  • model (obligatorio): ID del modelo de destino.
  • messages (obligatorio): mensajes ordenados con los roles system|user|assistant|tool; el contenido puede ser texto o partes.
  • Muestreo: temperature (0–2), top_p (0–1), top_k (>=1), seed (entero, opcional).
  • Longitud y penalizaciones: max_output_tokens (entero), presence_penalty y frequency_penalty (-2 a 2), stop (string|string[]).
  • Herramientas: tools (definiciones), tool_choice (auto/none/herramienta específica), max_tool_calls (entero), parallel_tool_calls (booleano).
  • Logprobs: logprobs (booleano), top_logprobs (0–20).
  • Salida: response_format (json/text), metadata (objeto transferido), stream (booleano), service_tier.
  • Extras del gateway: usage (booleano para solicitar el uso), meta (booleano para incluir el bloque meta).

Devuelve

ChatCompletionsResponse
O líneas SSE durante la transmisión
Última modificación el 2 de octubre de 2026