Skip to main content
Méthode: client.generateText() (diffusez les fragments analysés avec client.streamChat()).

Exemple

Diffusion en continu

Paramètres principaux

  • model (required): ID du modèle cible.
  • messages (required): Messages ordonnés avec les rôles system|user|assistant|tool ; le contenu peut être une chaîne ou plusieurs parties.
  • Échantillonnage : temperature (0–2), top_p (0–1), top_k (>=1), seed (int, optional).
  • Longueur/pénalités : max_output_tokens (int), presence_penalty and frequency_penalty (-2 to 2), stop (string|string[]).
  • Outils : tools (définitions), tool_choice (auto/none/outil spécifique), max_tool_calls (int), parallel_tool_calls (bool).
  • Logprobs : logprobs (bool), top_logprobs (0–20).
  • Sortie : response_format (json/text), metadata (object passthrough), stream (bool), service_tier.
  • Options Gateway supplémentaires : usage (bool pour demander les données d’utilisation), meta (bool pour inclure le bloc meta).

Réponse

ChatCompletionsResponse
Ou des trames SSE lorsque stream: true :
Dernière modification le 2 octobre 2026