तरीके: client.generate_text(...), client.create_chat_completion(...)।
उदाहरण
मुख्य पैरामीटर
model (ज़रूरी): लक्ष्य model ID।
messages (ज़रूरी): user/system/assistant/tool roles वाले क्रमबद्ध messages; content text के रूप में होता है।
- नमूना चयन:
temperature (0–2), top_p (0–1), top_k (>=1), seed (वैकल्पिक पूर्णांक)।
- लंबाई/penalties:
max_output_tokens (integer), presence_penalty और frequency_penalty (-2 से 2), stop (string या string array)।
- टूल:
tools (परिभाषाएँ), tool_choice (auto/none/विशिष्ट टूल), max_tool_calls (पूर्णांक), parallel_tool_calls (बूलियन)।
- लॉग प्रायिकताएँ:
logprobs (बूलियन), top_logprobs (0–20)।
- आउटपुट:
response_format (json/text), metadata (बिना बदलाव आगे भेजा गया ऑब्जेक्ट), stream (बूलियन), service_tier।
- Gateway के अतिरिक्त विकल्प:
usage (उपयोग आँकड़े माँगने के लिए बूलियन), meta (मेटा ब्लॉक शामिल करने के लिए बूलियन)।
लौटाया गया मान
ChatCompletionsResponse अंतिम संशोधन 2 अक्टूबर 2026