Skip to main content
Méthode: client.generateResponse() (diffusez les fragments analysés avec client.streamResponses()).

Exemple

Diffusion en continu

Paramètres principaux

  • model (required): ID du modèle cible.
  • input (required): Tableau ordonné d’éléments d’entrée (messages, appels d’outils, etc.).
  • temperature (0-2): Une valeur plus élevée augmente l’aléatoire.
  • top_p (0-1) / top_k (>=1): Paramètres d’échantillonnage nucleus / top-k.
  • max_output_tokens (int): Limite maximale du nombre de tokens générés par réponse.
  • Outils : tools (définitions), tool_choice (auto/none/spécifique), max_tool_calls (int), parallel_tool_calls (bool).
  • Logprobs : logprobs (bool), top_logprobs (0-20) pour renvoyer les logprobs de chaque token.
  • Sortie : response_format (json/text), service_tier, store (bool), stream (bool).
  • Métadonnées : metadata (object) pour le transfert sans modification, reasoning (object) pour indiquer le niveau d’effort.
  • Options Gateway supplémentaires : usage (bool pour demander les données d’utilisation), meta (bool pour inclure le bloc meta).

Réponse

ResponsesResponse
Ou des trames SSE délimitées par des retours à la ligne lorsque stream: true :
Dernière modification le 2 octobre 2026