Skip to main content
Mit Tool-Aufrufen können Modelle strukturierte Aktionen anfordern (z. B. Datenbankabfragen, Wetterprüfungen oder interne API-Aufrufe), statt Antworten zu erraten. Das Gateway unterstützt Tool-Payloads über diese Text-Endpunkte:
  • /v1/chat/completions (OpenAI-typische tools und tool_calls)
  • /v1/responses (Antworts-typische function_call-Ausgabeelemente)
  • /v1/messages (Anthropic-typische tool_use-Blöcke)

Anfrage

Antwort

Führe dein Tool aus und sende das Ergebnis in der nächsten Anfrage zurück, damit der Assistent die Antwort abschließen kann.

Integrierte Server-Tools

Das Gateway stellt derzeit folgende integrierte Server-Tools bereit:
  • gateway:datetime
  • phaseo:web_search
  • phaseo:web_fetch
  • phaseo:advisor
  • phaseo:image_generation
  • phaseo:apply_patch
Dieses Tool wird auf Gateway-Seite ausgeführt; ein clientseitiger Executor ist nicht erforderlich. Das Gateway wandelt es in einen vorgelagerten Tool- oder Funktionsaufruf um, führt ihn aus und gibt das Ergebnis an den Modellablauf zurück. Ausführliche Informationen zu Konfiguration, Nutzung und Abrechnung findest du unter Server-Tools. Unterstütztes Anfrageformat:
Hinweise:
  • parameters.timezones ist optional und kann bis zu 5 gültige IANA-Zeitzonen in einem Aufruf anfordern.
  • Das Ergebnis enthält ein timezones-Array mit ISO-Datum und -Uhrzeit sowie der aufgelösten Zeitzone für jede angeforderte Zone.
  • Die Nutzung umfasst usage.server_tool_use.datetime_requests.
  • Verwende bevorzugt tool_choice: "auto", damit das Modell selbst entscheiden kann, wann es das Tool aufruft.

Websuchbeispiel

Hinweise:
  • Das Modell gibt die Suchanfrage beim Tool-Aufruf an.
  • engine: "auto" nutzt verwaltete Exa-Suche. engine: "exa", engine: "parallel", engine: "firecrawl" und engine: "tinyfish" führen verwaltete Gateway-Suche aus, wenn der entsprechende Anbieterschlüssel konfiguriert ist.
  • TinyFish Search unterstützt lokalisierte, paginierte und sortierte Ergebnisse und ist in den veröffentlichten Tarifen kostenlos; verwende bei Bedarf language und page in den Tool-Parametern.
  • engine: "native" wird bei phaseo:web_search für die jeweilige Anfrageoberfläche in das native Websuch-Tool des Providers umgewandelt, etwa OpenAIs web_search_preview oder Anthropics web_search_20250305.
  • max_results begrenzt die Ergebnisse pro Suchaufruf; max_total_results begrenzt die Gesamtergebnisse im Server-Tool-Ablauf.
  • Die verwaltete Suche unterstützt allowed_domains / excluded_domains, search_context_size und max_characters, sofern die ausgewählte Suchmaschine entsprechende Einstellungen anbietet.
  • Die Nutzung umfasst usage.server_tool_use.web_search_requests, usage.server_tool_use.web_search_results und usage.server_tool_use.web_search_extra_results.
  • Die verwaltete Exa-Suche kann über die Meter server_tool_web_search_requests und server_tool_web_search_extra_results abgerechnet werden.

Webabruf-Beispiel

Hinweise:
  • Das Modell gibt beim Tool-Aufruf die Ziel-url an.
  • Unterstützt werden nur HTTP(S)-URLs und textähnliche Inhaltstypen.
  • engine: "auto" verwendet auf der Anthropic-Messages-Oberfläche den nativen Abruf, sonst Exa bei konfiguriertem EXA_API_KEY und andernfalls den direkten HTTP-Abruf des Gateways.
  • engine: "direct" verwendet den direkten HTTP-Abruf des Gateways. engine: "exa" nutzt die Inhaltsextraktion von Exa, wenn EXA_API_KEY konfiguriert ist.
  • engine: "parallel" verwendet Parallel Extract, wenn PARALLEL_API_KEY konfiguriert ist. engine: "firecrawl" verwendet Firecrawl Scrape, wenn FIRECRAWL_API_KEY konfiguriert ist.
  • Auf der Anthropic-Messages-Oberfläche wird engine: "native" in Anthropics natives Tool web_fetch_20260209 umgewandelt. Auf anderen Anfrageoberflächen solltest du engine: "direct" oder eine verwaltete Extraktions-Engine verwenden.
  • Wenn max_chars fehlt, wird max_content_tokens als Alias zur Begrenzung der Abrufgröße in Token akzeptiert.
  • allowed_domains und blocked_domains begrenzen die abrufbaren URLs.
  • HTML-Inhalte werden auf Text mit begrenzter Länge reduziert, bevor sie in den Modellablauf zurückgegeben werden.
  • Die Nutzung umfasst usage.server_tool_use.web_fetch_requests.
  • Für den verwalteten Abruf kann das Meter server_tool_web_fetch_requests verwendet werden. Native Abruf- und Suchnutzung des Providers wird über native_web_fetch_requests und native_web_search_requests abgerechnet; Modellpreiskarten können die Provider-Standardwerte überschreiben.
Beispiel für nativen Anthropic-Abruf:

Advisor-Beispiel

Hinweise:
  • Advisor wird vom Gateway verwaltet und funktioniert mit unterstützten Textmodellen. Das aufrufende Modell erhält ein phaseo_advisor-Tool oder eine benannte Variante wie phaseo_advisor_reviewer; das Gateway führt die Advisor-Anfrage aus.
  • parameters.name ist optional. Verwende eindeutige Namen, um mehrere Advisors bereitzustellen. Namen dürfen Buchstaben, Zahlen, Leerzeichen, Unterstriche und Bindestriche enthalten.
  • parameters.model legt das Advisor-Modell fest. Fehlt der Parameter, kann der Tool-Aufruf model angeben; andernfalls verwendet das Gateway das Modell der äußeren Anfrage.
  • parameters.forward_transcript ist standardmäßig false. Setze den Wert auf true, wenn Advisor den aktuellen Gesprächsverlauf erhalten soll.
  • Das Modell gibt beim Tool-Aufruf normalerweise den Advisor-prompt an. Bei forward_transcript auf true kann das Gateway einen Advisor-Aufruf nur mit dem Gesprächsverlauf ausführen, wenn kein Prompt angegeben ist. max_tokens wird als veralteter Alias für max_completion_tokens akzeptiert.
  • Die Nutzung umfasst usage.server_tool_use.advisor_requests.

Beispiel für Bildgenerierung

Hinweise:
  • Beim Tool-Aufruf gibt das Modell den Bild-prompt an. description wird ebenfalls als Prompt-Alias akzeptiert.
  • parameters.model legt das Bildmodell fest. Fehlt der Parameter, kann der Tool-Aufruf model angeben; andernfalls verwendet Phaseo das Standard-Bildmodell.
  • Das Tool-Ergebnis enthält je nach Provider-Antwort entweder imageUrl oder base64-kodierte Bilddaten.
  • Die Nutzung umfasst usage.server_tool_use.image_generation_requests; der Tokenverbrauch des Bildmodells wird der übergeordneten Anfrage zugerechnet.

Beispiel für Patch-Anwendung

Hinweise:
  • Die Responses API unterstützt phaseo:apply_patch.
  • Phaseo validiert die Patch-Operationen und gibt sie im Tool-Ergebnis zurück. Dein Client entscheidet, ob der Patch angewendet oder abgelehnt wird.
  • Unterstützte Operationstypen sind create_file, update_file und delete_file.
  • Die Nutzung umfasst usage.server_tool_use.apply_patch_requests.

Streaming-Verhalten

Tool-Aufrufe können auch stream: true verwenden. Bei gatewayverwalteten Server-Tools kann das Gateway:
  • den vorgelagerten Tool-Aufruf-Zug materialisieren
  • das Server-Tool ausführen
  • den Modellablauf fortsetzen
  • einen synthetischen Stream an den Client zurücksenden
So bleibt der clientseitige Vertrag streamingfreundlich, auch wenn das Gateway Teile des Tool-Ablaufs selbst ausführt.

Nächste Anleitungen

  1. Muster für Tool-Aufrufe
  2. Sicherheit und Validierung von Tool-Aufrufen
  3. Strukturierte Ausgaben
Zuletzt geändert am 2. Oktober 2026