Methods: generateResponse(), createResponse()
Example
Key parameters
model (required): Target model id.
input (required): Ordered array of input items (messages, tool calls, etc.).
temperature (0–2): Higher = more random.
top_p (0–1): Nucleus sampling control.
max_output_tokens (int): Hard cap on tokens generated per response.
- Tools:
tools (definitions), tool_choice (auto/none/specific), max_tool_calls (int), parallel_tool_calls (bool).
- Logprobs:
top_logprobs (0–20) to return per-token logprobs.
- Output:
service_tier, store (bool), stream (bool).
- Metadata:
metadata (object) for passthrough, reasoning (object) for effort hints.
- Gateway extras:
usage (bool to request usage), meta (bool to include meta block).
Returns
ResponsesResponse JSON object. Last modified on July 26, 2026