Skip to main content
Méthode : client.generate_text() (diffusez les fragments analysés avec client.stream_chat()).

Exemple

Diffusion en continu

Paramètres clés

  • model (obligatoire) : ID du modèle cible.
  • messages (obligatoire) : messages ordonnés avec les rôles system|user|assistant|tool ; le contenu peut être du texte ou des parties.
  • Échantillonnage : temperature (0–2), top_p (0–1), top_k (>=1), seed (entier facultatif).
  • Longueur et pénalités : max_output_tokens (entier), presence_penalty et frequency_penalty (-2 à 2), stop (string|string[]).
  • Outils : tools (définitions), tool_choice (auto/none/outil spécifique), max_tool_calls (entier), parallel_tool_calls (booléen).
  • Logprobs : logprobs (booléen), top_logprobs (0–20).
  • Sortie : response_format (json/text), metadata (objet transmis), stream (booléen), service_tier.
  • Options de la passerelle : usage (booléen pour demander les données d’utilisation), meta (booléen pour inclure le bloc meta).

Retour

ChatCompletionsResponse
Ou des lignes SSE pendant le streaming
Dernière modification le 2 octobre 2026