OpenAI GPT-5.6
استخدم هذا الدليل لاعتماد عائلة GPT-5.6 بأمان في بيئة الإنتاج. GPT-5.6 هي عائلة GPT الحالية من OpenAI لسير العمل الإنتاجي المعقد. وفي AI Stats، تقابل معرّفات المستويات الثابتة معرّفات نماذج OpenAIgpt-5.6-sol وgpt-5.6-terra وgpt-5.6-luna.
البدء السريع للترحيل
- اختر نموذج Sol أو Terra أو Luna الثابت الذي يناسب عبء العمل.
- استبدل معرّف النموذج فقط وأبقِ بقية الطلب كما هي.
- أعد اختبار مستوى الاستدلال والمخرجات المنظمة والأدوات وزمن الاستجابة وتكلفة المهمة.
- أطلق المسار الجديد تدريجيًا مع إبقاء نموذج GPT-5 السابق كخيار احتياطي.
اختر نموذجًا
يوجّه الاسم المستعار
gpt-5.6 من OpenAI إلى gpt-5.6-sol. في AI Stats، استخدم openai/gpt-5.6 أو openai/gpt-sol-latest عند الرغبة في اعتماد Sol افتراضيًا، واستخدم معرّفات المستويات الثابتة للتحكم في التوجيه.
يتتبع AI Stats أيضًا الأسماء المستعارة لأحدث نموذج في كل مستوى: openai/gpt-sol-latest وopenai/gpt-terra-latest وopenai/gpt-luna-latest. استخدم معرّفات GPT-5.6 الثابتة للترحيلات المضبوطة، ولا تستخدم أسماء المستويات المستعارة إلا إذا أردت عمدًا تمرير إصدارات Sol أو Terra أو Luna المستقبلية عبر المسار نفسه.
ما الجديد
- يضيف GPT-5.6 تقسيم Sol/Terra/Luna الجديد بدلًا من مسار GPT افتراضي واحد.
- تدعم مستويات GPT-5.6 الثلاثة
reasoning.effort: "max"لأعلى ميزانية استدلال. - يدعم GPT-5.6
reasoning.mode: "pro"دون التبديل إلى معرّف نموذج Pro منفصل. - يضيف GPT-5.6 عناصر تحكم مستمرة للاستدلال عبر
reasoning.context. - يضيف GPT-5.6 دعمًا تجريبيًا للوكلاء المتعددين وProgrammatic Tool Calling لسير العمل المؤهل كثيف الأدوات.
- يُسعّر التخزين المؤقت للموجّهات عبر عدادات منفصلة للإدخال غير المخزن مؤقتًا وقراءة الذاكرة وكتابتها والإخراج.
- يُدعم التخزين المؤقت الصريح للموجّهات عبر
prompt_cache_options؛ وتوصي OpenAI حاليًا باستخدامprompt_cache_options.ttlبدلًا منprompt_cache_retention.
حدّث طلبك
ابدأ باستبدال معرّف النموذج فقط مع إبقاء بقية الطلب دون تغيير. تستخدم الأمثلة الأولى بنيةinput بأسلوب Responses API. إذا كنت ترحّل حركة Chat Completions، فاستمر في استخدام messages وحقل reasoning_effort المسطح عندما يدعم المسار ذلك.
max فقط في المسارات التي تستحق فيها ميزانية الاستدلال الإضافية زمن الاستجابة والتكلفة.
reasoning_effort عندما يدعمه المسار:
راجع الأسعار
تُسجّل أسعار GPT-5.6 في الكتالوج لكل مليون رمز.
تُحتسب قراءات ذاكرة التخزين المؤقت بصورة منفصلة عن الكتابة. ويمنح الكتالوج الحالي خصمًا قدره 90% على القراءات مقارنةً بالإدخال غير المخزن مؤقتًا، بينما تبلغ تكلفة الكتابة 1.25 ضعف سعر ذلك الإدخال.
استخدم التخزين المؤقت للموجّهات بوعي
عند تكرار السياق، ضع الجزء الثابت من الموجّه في كتل قابلة للتخزين المؤقت واترك النص الخاص بكل طلب خارج التخزين المؤقت.cache_control لتلميحات التخزين المؤقت المحايدة للمزود أو نقاط الفصل الصريحة. واستخدم prompt_cache_options لتمرير وضع التخزين المؤقت وخيارات TTL من OpenAI مباشرةً.
ما الذي ينبغي اختباره
الاستدلال وجودة المخرجات
- اختبر Sol وTerra وLuna بمستويات الجهد التي تنوي إتاحتها للمستخدمين، بما فيها
maxعندما تبرر مسارات العمل التي تعطي الأولوية للجودة ذلك - قارن وضع standard مع
reasoning.mode: "pro"في المهام الصعبة التي تكون فيها الجودة أهم من زمن الاستجابة - المخرجات المنظمة ومعدل اجتياز المخطط لكل مستوى جهد
- اختيار استدعاءات الأدوات وجودة الوسيطات
التكلفة وزمن الاستجابة
- زمن الاستجابة عند كل مستوى جهد استدلال
- زيادة رموز المخرجات مقارنةً بخط الأساس الحالي في الإنتاج
- مزيج قراءات ذاكرة التخزين المؤقت وكتابتها عند تكرار المطالبات
- تكلفة كل مهمة ناجحة، وليس سعر الرمز فقط
التراجع
- أبقِ مسار GPT-5.x السابق متاحًا كخيار احتياطي
- أبقِ
maxخلف علامة إعداد أو preset حتى يتم التحقق منه باستخدام مطالبات شبيهة ببيئة الإنتاج - راقب حجم كتابة ذاكرة التخزين المؤقت منفصلًا عن حجم قراءتها
- لا تضف GPT-5.6 إلى التوجيه الافتراضي إلا بعد أن تؤكد تقييماتك نجاح المهام والتكلفة وزمن الاستجابة