Skip to main content
Methode: client.generateResponse() (übertrage verarbeitete Chunks mit client.streamResponses()).

Beispiel

Datenstrom

Wichtige Parameter

  • model (erforderlich): ID des Zielmodells.
  • input (erforderlich): Geordnetes Array von Eingabeelementen (Nachrichten, Tool-Aufrufe usw.).
  • temperature (0-2): Ein höherer Wert erhöht die Zufälligkeit.
  • top_p (0-1) / top_k (>=1): Parameter für Nucleus-/Top-k-Sampling.
  • max_output_tokens (int): Obergrenze für die pro Antwort generierten Tokens.
  • Werkzeuge: tools (Definitionen), tool_choice (auto/none/spezifisches Werkzeug), max_tool_calls (int), parallel_tool_calls (bool).
  • Logprobs: logprobs (bool), top_logprobs (0-20) um Logprobs pro Token zurückzugeben.
  • Ausgabe: response_format (json/text), service_tier, store (bool), stream (bool).
  • Metadaten: metadata (object) zur unveränderten Weitergabe, reasoning (object) als Hinweis zum Denkaufwand.
  • Zusätzliche Gateway-Optionen: usage (bool, um Nutzungsdaten anzufordern), meta (bool, um den Meta-Block einzuschließen).

Rückgabe

ResponsesResponse
Oder zeilengetrennte SSE-Frames bei stream: true:
Zuletzt geändert am 2. Oktober 2026