Skip to main content
Methode: client.generate_text() (übertrage verarbeitete Chunks mit client.stream_chat()).

Beispiel

Datenstrom

Wichtige Parameter

  • model (erforderlich): ID des Zielmodells.
  • messages (erforderlich): geordnete Nachrichten mit den Rollen system|user|assistant|tool; der Inhalt kann aus Text oder Teilen bestehen.
  • Sampling: temperature (0–2), top_p (0–1), top_k (>=1), seed (optionale Ganzzahl).
  • Länge und Penalties: max_output_tokens (Ganzzahl), presence_penalty und frequency_penalty (-2 bis 2), stop (string|string[]).
  • Tools: tools (Definitionen), tool_choice (auto/none/bestimmtes Tool), max_tool_calls (Ganzzahl), parallel_tool_calls (boolesch).
  • Logprobs: logprobs (boolesch), top_logprobs (0–20).
  • Ausgabe: response_format (json/text), metadata (durchgereichtes Objekt), stream (boolesch), service_tier.
  • Gateway-Erweiterungen: usage (boolesch, um Nutzungsdaten anzufordern), meta (boolesch, um den Meta-Block einzuschließen).

Rückgabe

ChatCompletionsResponse
Oder SSE-Zeilen beim Streaming
Zuletzt geändert am 2. Oktober 2026