
GPT-5.6 Sol Ultra في Codex: ماذا يفعل وضع الوكلاء الفرعيين فعلياً (وكم يكلّف)
حتى يوليو 2026، لا يزال GPT-5.6 Sol Ultra في معاينة مغلقة لمجموعة صغيرة من نحو 20 شريكاً معتمداً من جهات حكومية، ويمكن الوصول إليه عبر واجهة OpenAI API وCodex. هو ليس متاحاً على نطاق واسع بعد. لم تنشر OpenAI تاريخاً للإطلاق العام، ورقم 91.9% في Terminal-Bench المتداول على نطاق واسع لا يظهر على صفحة المعاينة الرسمية لـOpenAI.
في 26-06-2026، عرضت OpenAI عائلة GPT-5.6 Sol، وبعد أيام قليلة طلب Thibault Sottiaux من مستخدمي Codex أن "يدّخروا أصعب طلباتهم" لفئة Sol Ultra. تلك التلميحة الواحدة أطلقت موجة من لقطات شاشة للمقاييس. معظمها يكرر رقماً لم تنشره OpenAI أبداً. لذا قبل أن تبني سير عملك في Codex حول GPT-5.6 Sol Ultra، هذا ما تأكد فعلاً، وكيف يعمل وضع الوكلاء الفرعيين، وحسابات التوكِنات التي تحدد إن كان الأمر يستحق التفعيل.
أهم النقاط:
- Sol Ultra هي فئة الجهد الأعلى في GPT-5.6: وكلاء فرعيون متعاونون يتحدثون مع بعضهم خلال المهمة نفسها.
- في معاينة مغلقة لنحو 20 شريكاً معتمداً من جهات حكومية عبر API وCodex، وليست متاحة على نطاق واسع (حتى يوليو 2026).
- تتداول الصحافة رقم 91.9% على Terminal-Bench 2.1، لكن OpenAI لم تنشر هذا الرقم، فتعامل معه كغير موثّق.
- يعمل Sol بسعر 5 دولارات للإدخال و30 دولاراً للإخراج لكل مليون توكِن؛ والوكلاء الفرعيون يضاعفون عدد الاستدعاءات، فيمكن أن تكلّف Ultra عدة أضعاف تشغيل وكيل واحد.
GPT-5.6 Sol Ultra في Codex: ما تأكد فعلاً
هذا هو التقسيم الواضح. المؤكد: عرضت OpenAI عائلة Sol (Sol وTerra وLuna) في 26-06-2026، وSol Ultra هي فئة الاستدلال الأعلى، وقد أُشير إليها بالفعل لصالح Codex. غير المؤكد: رقم 91.9% على Terminal-Bench 2.1 وأي تاريخ إطلاق عام. كل ما رأيته غير ذلك هو تغطية صحفية، لا معطيات رسمية من الشركة.
هذا الفارق مهم لأن هذا الإطلاق سار بسرعة ودون كثير من الدقة. صفحة معاينة OpenAI تصف الفئات وضوابط السلامة بعبارات وصفية عامة. أما جدول المقاييس اللافت المتداول على X وفي الدلائل، فيأتي من تغطية ثانوية، لا من صفحة OpenAI نفسها. في مرحلة ما قبل الإطلاق، قيّمنا الشائعات المسبقة، وهذا ما صدر فعلاً في مقابل ما بقي تخميناً. وينطبق نفس المنطق الآن.
فإذا كنت مطوراً تحاول أن تقرر إن كان Ultra يستحق مكاناً في حلقة عملك على Codex، تجاهل الأرقام المضخّمة للحظة. الحقائق المؤكدة (الآلية والتسعير وحالة المعاينة) كافية للحكم على التكلفة والملاءمة. أما غير المؤكدة (الرقم الدقيق، تاريخ الإطلاق) فلا ينبغي أن تبني عليها قراراً واحداً بعد. المصادر: صفحة OpenAI Previewing GPT-5.6 Sol وتغطية 9to5Mac للإطلاق.
ما هي Sol Ultra؟ الوكلاء الفرعيون المتعاونون مقابل وكلاء Pro المتوازيين
Sol Ultra هي فئة الاستدلال الأعلى في GPT-5.6، وميزتها المحورية هي الوكلاء الفرعيون المتعاونون: منسّق يقسّم مهمتك إلى أجزاء، ويسلّم كل جزء لوكيل فرعي، وهؤلاء الوكلاء يتبادلون الرسائل مع بعضهم أثناء استمرار العمل. ذلك التواصل في منتصف المهمة هو جوهر الفكرة، وهو ما يفرّق Ultra عن كل الفئات الأدنى منها.
تخيّل الفرق بين فرقة مهندسين صغيرة ومجموعة عاملين مستقلين. الوكلاء المتوازيون في GPT-5.5 Pro يعملون كثلاثة عاملين مستقلين تسلّم كل واحد منهم تذكرة منفصلة. كل واحد يعمل بمعزل عن الآخر، ويعيد النتيجة لمكتبك دون أن يتكلم أحدهم مع الآخر. أما وكلاء Sol Ultra الفرعيون فيعملون كفرقة في غرفة واحدة: أحدهم يلاحظ أن مخطط قاعدة البيانات تغيّر، فيخبر الآخرين، فيعدّلون قبل إنهاء العمل. هذا التنسيق هو سبب توجيه OpenAI لهذه الفئة نحو المهام الطويلة والمعقدة متعددة الخطوات، لا التعديلات السريعة.
بينما تعمل وكلاء Pro في مسارات منفصلة، يتبادل وكلاء Sol Ultra الفرعيون الملاحظات فيما بينهم أثناء تشغيل المهمة نفسها.

الآلية نفسها مؤكدة، وصفتها OpenAI وتكرر ذكرها في تغطية DataCamp وdeeplearning.ai. الفخ، وسنتناوله بعد قليل، هو أن كل وكيل فرعي تستحدثه هو استدعاء نموذج إضافي يستهلك توكِنات. التنسيق ليس مجانياً.
ما هو "أقصى جهد استدلال" ومتى تفعّله؟
"أقصى جهد استدلال" هو أعلى درجة في سلّم الجهد في GPT-5.6، وهو سلّم يبدأ من منخفض ويمر بمرتفع ثم يصل إلى إعداد الحد الأقصى الذي تستخدمه Sol Ultra. الجهد الأعلى يعني أن النموذج يقضي وقتاً حسابياً أطول في التفكير قبل الإجابة، وهذا يساعد عادة في المسائل الصعبة ويهدر المال على المسائل السهلة. هو مقياس متدرج، لا مفتاح تشغيل تتركه مضبوطاً دائماً على الحد الأقصى.
تخيّل لاعب شطرنج. في الجهد المنخفض، يتحرك بسرعة بالحدس، وهذا مناسب للأسر الواضحة. وفي الجهد الأقصى، يجلس ويحسب عشر حركات مقدماً، وهذا مناسب تماماً لنهاية لعبة صعبة، وعبث تام لفتح باب. جهد الاستدلال يعمل بالمنطق نفسه؛ الحساب (والفاتورة) يتغير بحجم مقدار التفكير الذي تطلبه من النموذج.
فمتى يستحق الأمر؟ فعّل أقصى جهد للأعمال الوكيلية الطويلة متعددة الملفات: ترحيل يلامس عشرين ملفاً، أو إعادة هيكلة معقدة، أو خلل يمتد عبر ثلاث خدمات. هذا هو نطاق البرمجة الوكيلية طويلة المدى الذي يغيّر فيه الاستدلال العميق النتيجة فعلاً. اترك الإعداد منخفضاً عند إعادة تسمية متغيّر، أو كتابة اختبار واحد، أو تصحيح خطأ إملائي، لأنك ستدفع توكِنات باهظة لعائد صفري.
أقصى جهد استدلال يستحق تكلفته فقط حين تكون المهمة صعبة بما يكفي لأن يكلّفك خطأ في المحاولة الأولى أكثر من التوكِنات الإضافية.
القاعدة الصادقة: إن لم تستطع أن تفسّر لماذا هذه المهمة صعبة، فأنت غالباً لا تحتاج أقصى جهد لها.
أرقام Terminal-Bench 2.1: هل رقم 91.9% موثّق فعلاً؟
لا. رقم 91.9% منشور عبر الصحافة الثانوية، ولا يظهر على صفحة المعاينة الرسمية لـOpenAI، والمعاينة مغلقة، ولم يُكشف عن أي منهجية تقييم. لذا هو غير موثّق بشكل مستقل. تعامل معه كادّعاء صحفي لا يمكنك التحقق منه، لا كنتيجة محسومة.
هذه هي التفاصيل الدقيقة. تشير تغطيات مقرّبة من OpenAI (DataCamp، AI Weekly، deeplearning.ai) إلى أن Sol Ultra حققت 91.9% على Terminal-Bench 2.1. لكن بما أن المعاينة مغلقة على نحو 20 شريكاً ولم تنشر OpenAI الرقم أو شروط الاختبار، لا يمكن لأحد خارج تلك الدائرة إعادة إنتاج هذه النتيجة. لاحظ أيضاً أن رقم Claude Mythos 5 يختلف حسب من ينشره: بعض المصادر تقول 84.3%، وأخرى تقول 88.0%. فإذا كانت أرقام جدول مقارنة واحد متناقضة بين المصادر، فتلك إشارة إلى التعامل معها بحذر.
| النموذج | Terminal-Bench 2.1 (منشورة، غير موثّقة بشكل مستقل) |
|---|---|
| Sol Ultra | 91.9% |
| Sol (الأساسي) | 88.8% |
| GPT-5.5 | 88.0% |
| Claude Mythos 5 | 84.3-88.0% (يختلف حسب المصدر) |
| Gemini 3.1 Pro Preview | 70.7% |
رقم 91.9% الذي يتداوله الجميع لا يظهر على صفحة المعاينة الرسمية لـOpenAI، فتعامل معه كادّعاء صحفي، لا كنتيجة محسومة.
لا يعني شيء من ذلك أن Sol Ultra ضعيفة. قد تتصدر الجدول فعلاً حين تنشر OpenAI منهجية حقيقية. المهم فقط ألا توجّه حركة إنتاج فعلية بناءً على رقم لا تستطيع التحقق منه. المصادر: دليل DataCamp لـGPT-5.6 Sol، وThe Batch من deeplearning.ai، وAI Weekly.
كيف تستخدم Sol Ultra وأقصى جهد استدلال في Codex
Sol Ultra نفسها مقفلة، فلا يمكنك تفعيلها إلا إن كانت مؤسستك ضمن المعاينة. لكن سلّم الجهد الذي تقف عليه يعمل بالفعل في Codex CLI اليوم، على النماذج المتاحة لك. هكذا يعمل هذا الإعداد، وأين تحل Ultra محلّه عند الحصول على الوصول.
- حدد الإعداد. يعيش جهد الاستدلال في ملف إعداد Codex عند
~/.codex/config.toml، أو كخيار لكل تشغيل. هو ليس مدفوناً في قائمة؛ هو مفتاح واحد. - اضبط النموذج والجهد. وجّه Codex إلى نص النموذج وحدد درجة الجهد. يمكنك اليوم الضبط من منخفض إلى مرتفع؛ الدرجة "القصوى" مع فئة الوكلاء الفرعيين في Sol Ultra تُفتحان عند دخول مؤسستك في المعاينة.
- تجاوز الإعداد لمهمة واحدة. استخدم خيار
-cلرفع الجهد لتشغيل صعب واحد دون تعديل ملف الإعداد. - فعّل الجهد الأقصى بانتقائية. احتفظ به للمهام الطويلة متعددة الملفات المذكورة أعلاه. اترك إعدادك الافتراضي على متوسط أو مرتفع.
# ~/.codex/config.toml
model = "gpt-5.6-sol"
model_reasoning_effort = "high" # minimal | low | medium | high (متاحة اليوم)
# جهد "max" + فئة الوكلاء الفرعيين المتعاونين في Sol Ultra
# فعّلها عند دخول مؤسستك في المعاينة المغلقة:
# model = "gpt-5.6-sol-ultra"
# model_reasoning_effort = "max"
# تجاوز لكل تشغيل، دون تعديل ملف الإعداد:
# codex -c model_reasoning_effort="high" "refactor the auth module"نصيحة عملية: اضبط إعداد مشروعك الافتراضي على high، لا max. ثم تجاوز إلى الحد الأقصى فقط في التشغيل المحدد الذي يحتاجه. هذه العادة الواحدة تحفظ فاتورتك الأساسية معقولة وتحفظ الفئة الأغلى للمهام التي تستحقها فعلاً. تفاصيل التوفر موجودة في مقالة مركز مساعدة OpenAI عن المعاينة.
كم تكلّف Ultra فعلاً: مضاعِف توكِنات الوكلاء الفرعيين
هذا هو الجزء الذي لا يحسبه أحد: بما أن Ultra تستحدث وكلاء فرعيين متعاونين، فمهمة واحدة تُطلق عدة استدعاءات نموذج بدلاً من واحد، وكل استدعاء يُحاسَب بالتوكِنات. تسعير Sol المؤكد هو 5 دولارات لكل مليون توكِن إدخال، و0.50 دولار للمُخبَّأة، و30 دولاراً لكل مليون توكِن إخراج. الإخراج هو الجانب المكلف، وUltra تنتج كمية أكبر منه بكثير.
لنعمل على مثال حقيقي. لنأخذ مهمة وكيلية متوسطة التعقيد على Sol الأساسي، بوكيل واحد:
| النموذج | المكوّن | التوكِنات | السعر / مليون | التكلفة |
|---|---|---|---|---|
| Sol (الأساسي) | الإدخال | 40,000 | 5 دولارات | 0.20 دولار |
| Sol (الأساسي) | الإخراج | 15,000 | 30 دولاراً | 0.45 دولار |
| Sol (الأساسي) | الإجمالي | 0.65 دولار |
والآن نفس المهمة على Ultra مع منسّق وثلاثة وكلاء فرعيين متعاونين. السياق المشترك يُخبَّأ بسعر منخفض 0.50 دولار، لكن كل وكيل فرعي يبقى ينتج مخرجاته بسعر 30 دولاراً:
| النموذج | المكوّن | التوكِنات | السعر / مليون | التكلفة |
|---|---|---|---|---|
| Sol Ultra (مُحاكاة) | إدخال المنسّق | 40,000 | 5 دولارات | 0.20 دولار |
| Sol Ultra (مُحاكاة) | إدخال الوكلاء الفرعيين، مُخبَّأ | 90,000 | 0.50 دولار | 0.045 دولار |
| Sol Ultra (مُحاكاة) | إدخال الوكلاء الفرعيين، جديد | 30,000 | 5 دولارات | 0.15 دولار |
| Sol Ultra (مُحاكاة) | إخراج المنسّق والتواصل بين الوكلاء | 20,000 | 30 دولاراً | 0.60 دولار |
| Sol Ultra (مُحاكاة) | إخراج الوكلاء الفرعيين (3 × 15 ألف) | 45,000 | 30 دولاراً | 1.35 دولار |
| Sol Ultra (مُحاكاة) | الإجمالي | ~2.35 دولار |
هذا يعادل تقريباً 3.6 أضعاف تكلفة Sol الأساسي لنفس المهمة، وحسب عدد الوكلاء الفرعيين الذين يُستحدثون ومقدار السياق المخبَّأ، سترى نطاقاً من 2x إلى 4x. المضاعِف هو تقديرنا المُحاكى من التسعير المنشور، لا قياس فعلي لـUltra، لكن التسعير والآلية كليهما مؤكدان، فالشكل العام حقيقي.
التكلفة الخفية في Ultra ليست في سعر التوكِن، بل في أن مهمة واحدة تتحول بهدوء إلى أربع استدعاءات نموذج.
أمران يخفّفان هذا: التخزين المؤقت للطلبات (سعر 0.50 دولار المُخبَّأ) على السياق المشترك، والتوجيه المنضبط بحيث تدفع أسعار Ultra فقط على المهام التي تحتاجها. إن كنت جاداً بشأن الفاتورة، دليلنا عن كيفية التحكم في تكاليف واجهات LLM يغطي أنماط التوجيه التي نستخدمها في خطوط أنابيب عملائنا. التسعير مصدره DataCamp وdeeplearning.ai، بتاريخ يمتد من 2026-06 إلى 2026-07.
هل يمكنك استخدامها الآن؟ المعاينة المحدودة، ونحو 20 شريكاً، والجدول الزمني
ليس إلا إن كنت أحد نحو 20 شريكاً موثوقاً ومعتمداً من جهات حكومية. Sol Ultra في معاينة مغلقة يمكن الوصول إليها عبر OpenAI API وCodex، محصورة خلف مراجعة سلامة حكومية قبل الإطلاق الأوسع. قالت OpenAI إن الوصول الأوسع "قادم في الأسابيع المقبلة"، ولم تحدد أكثر من ذلك.
قد تكون رأيت تاريخ "7 يوليو" يتردد. تجاهله. لم تُصدر OpenAI أي تاريخ إطلاق، فتعامل مع أي يوم محدد كثرثرة غير مؤكدة، لا كحقيقة تخطط عليها. المؤكد هو صياغة "الأسابيع المقبلة"، وأن Cerebras مستعدة لتقديم Sol بسرعة تصل إلى 750 توكِن في الثانية بدءاً من يوليو (حسب deeplearning.ai).
فماذا تفعل إن لم تكن شريكاً؟ استعدّ الآن. اضبط إعداد Codex وسلّم الجهد على النماذج المتاحة لك اليوم، حتى يكون تغيير نص النموذج هو التعديل الوحيد الذي تحتاجه عند فتح Ultra. صندوق القرار: هل أنت شريك موثوق؟ لا؟ فأعدّ توجيه مستويات الجهد اليوم وكن جاهزاً لاستبداله بسطر واحد. المصادر: مركز مساعدة OpenAI وdeeplearning.ai.
Sol Ultra في مقابل Sol وGPT-5.5 وClaude Mythos 5: أيهم تختار؟
وجّه اختيارك حسب المهمة، لا حسب لوحة الترتيب، خصوصاً حين تكون أرقام تلك اللوحة غير موثّقة. اختر Sol الأساسي لمعظم أعمال البرمجة الوكيلية اليومية، واحتفظ بـSol Ultra للمهام الطويلة الصعبة فعلاً، وابقَ على GPT-5.5 إن كان مدمجاً في مجموعتك التقنية بالفعل، وفكّر في Claude Mythos 5 حيث تثق أصلاً في أحدث إصدارات Claude لسير عملك.
هذا هو التصور العملي:
- اختر Sol الأساسي حين تكون المهمة صعبة بشكل معتاد: ميزة، أو إعادة هيكلة محصورة، أو مجموعة اختبارات. حققت رقماً منشوراً 88.8% وتكلّف جزءاً بسيطاً من تكلفة Ultra.
- اختر Sol Ultra حين تكون المهمة طويلة، وتمتد عبر ملفات كثيرة، وسيكلّفك خطأ في المحاولة الأولى وقتاً حقيقياً. هنا، إن كان في أي مكان، تكسب الوكلاء الفرعيون المتعاونون مضاعِف تكلفتهم.
- اختر GPT-5.5 حين يكون مدمجاً بالفعل ولا يبرّر الفرق مقارنة بـSol عملية ترحيل.
- اختر Claude Mythos 5 حين تفضّله أدوات فريقك الحالية. رقمه المنشور يختلف حسب المصدر (84.3% إلى 88.0%)، فلا تحوّل بناءً على الرقم فقط.
للمزيد حول موازنات توجيه النماذج بين الأدوات، مقارنتنا لأدوات البرمجة الوكيلية تفصّل أين يلائم كل منها. والخلاصة المختصرة: اختر أرخص فئة تتجاوز عتبة صعوبة مهمتك.
ماذا يقول المطورون فعلاً على Reddit
المقاييس شيء، وما يرصده الناس في نوافذ أوامرهم الخاصة شيء آخر، والآن مواضيع r/codex هي أصدق إشارة متوفرة لنا. قراءتنا للمزاج العام: تفاؤل حذر، وشك عميق، ونقاش أكثره يدور حول السعر.
الإطراء المبكر من التجربة الفعلية محدد ودقيق. في موضوع على r/codex نال 335 تصويتاً إيجابياً، قال مطوّر لاحظ أن طلباته توجَّه إلى 5.6 إنها بدت "أسرع بمرتين" وكانت "تنجز طلباتي من محاولة واحدة"، بل "تصحّح استباقياً" حالات حدّية كانت تستغرق سابقاً عدة جولات مع 5.5. تشبيهه كان لافتاً: إنها "تشبه بالضبط Fable 5 حين جرّبته لفترة قصيرة في Claude، لكنها أسرع بكثير". أضاف معلّق زعم أن له وصولاً داخلياً أن تشغيل "المهام على أقصى مستوى استدلال" يستغرق "وقتاً أقل بكثير من 5.5".
ثم يظهر المخضرمون. أبرز تيار معارض هو ما نسمّيه شكّاً من نوع "شهر العسل ثم التقليم": كتب أحدهم "هذا يحدث دائماً وسيستمر نحو أسبوعين قبل التقليم". وكان آخر أكثر صراحة: "استخدموها بقوة لأسبوعين لأنها ستكون بذكاء أينشتاين لأسبوعين فقط". أشار قلة إلى التوقيت نفسه، ملاحظين أن منشورات الإطراء بـ5.6 تظهر بالتحديد عندما تبلغ شكاوى تراجع 5.5 قمّتها. والمثير أن أعلى الردود تصويتاً في ذلك الموضوع لم تكن تحليلاً على الإطلاق، بل نكاتاً ("أنا أستخدم gpt 6 بالفعل")، وهذا يقول كثيراً عن مدى تعب المطورين من ضجيج الإصدارات المتكرر.
في موضوع الإعلان عن Sol Ultra Codex، انقلب النقاش تقريباً بالكامل إلى السعر، موجَّهاً بشكل مباشر إلى Claude. يقارن المطورون فئة Codex بـ200 دولار من OpenAI بعرض Fable من Anthropic، وقال عدد منهم إنهم يلغون اشتراك Claude Max 20x، أساساً لأن Fable "يستهلك الرصيد بضعف السرعة". الأمل المتكرر: "منافسة حقيقية لـClaude Fable. أفضل لنا كمستخدمين". والمخاوف المتكررة، وهي مخاوف نتشاركها فعلاً: "انخدعت من قبل بإعلانات OpenAI عن أشياء ثم حجبها خلف فئات أعلى، فلن أصدّق إلا حين أراها تعمل محلياً".
رأينا في Techsy: تقارير السرعة تتوافق مع ما يُفترض أن تقدّمه بنية خدمة أعلى إنتاجية، فنحن نصدّقها. أما ادّعاءات الإنجاز من محاولة واحدة فنتعامل معها كأمر واعد لكن غير مثبت على نطاق واسع، لأن نمط "أصبحت أغبى بعد أسبوعين" حقيقي، وقد شاهدناه يتكرر في إطلاقات سابقة. وشكّ السعر صحيح تماماً. حتى تصبح Sol Ultra في أداتك، مستقرة، عبر دورة فوترة كاملة، تعامل مع الحماس كمعاينة، لا كحكم نهائي.
ما رصدناه عند تشغيل مهام وكيلية على Codex
لنكن صريحين: لا يمكننا تشغيل Sol Ultra. هي محصورة على نحو 20 شريكاً ولسنا منهم، فلن نستشهد بأعداد توكِنات أو نتائج لم نقسها بأنفسنا. ما نستطيع فعله هو أقرب شيء صادق إلى ذلك. شغّلنا مهاماً وكيلية عبر Codex CLI على فئتنا الحالية، وعملنا على حساب دقيق لتكلفة الوكلاء الفرعيين من تسعير OpenAI المنشور 5/30 دولار.
يتصرف سلّم الجهد بالضبط كما تتوقع في الفئة التي جرّبناها. عند الجهد المنخفض والمتوسط، يعيد Codex النتائج بسرعة وينجز التعديلات المحصورة بشكل صحيح غالباً. لكن دفع مهمة صعبة متعددة الملفات عند جهد منخفض يجعله يتوقف قبل الاكتمال أو يفوت تبعية بين الملفات؛ ونفس المهمة عند جهد مرتفع يقضي وقتاً أطول بوضوح في التفكير قبل التنفيذ، ويحصل على جزء أكبر من التغيير في تمريرة واحدة. هذه المقايضة بين زمن التنفيذ والجودة هي السبب الكامل لوجود الدرجة القصوى.
نموذج التكلفة أعلاه (مثال الـ3.6 أضعاف تقريباً) هو التحليل الحقيقي من واقعنا الذي يمكننا الوقوف خلفه: هو حساب رياضي على تسعير مؤكد وآلية وكلاء فرعيين مؤكدة، موصوف كمُحاكاة، لا كقياس. في خطوط أنابيب عملائنا الوكيلية، نوجّه فئات النماذج حسب التكلفة بالفعل، وهذا هو الحساب الدقيق الذي سنجريه قبل تفعيل Ultra لأي عميل.
التعديل الإعدادي الوحيد المهم هو سطر model_reasoning_effort في config.toml المذكور أعلاه: نحتفظ بإعداد مشروعنا الافتراضي على high ونتجاوز إلى max لكل تشغيل، تماماً كما تصف النصيحة العملية أعلاه. وحين تُفتح Ultra بعد المعاينة، يعني هذا الترتيب أن استبدال نص النموذج هو التعديل الوحيد الذي سنقوم به، وحساب التكلفة أعلاه هو بالفعل الحساب الذي سنجريه قبل تفعيلها. سنحدّث هذا القسم بأرقام Ultra الفعلية بمجرد أن يتوفر لدينا وصول حقيقي، لا قبل ذلك.
عن الكاتب
مرت باتور هو المؤسس المشارك لـTechsy.io، حيث يبني الفريق وكلاء ذكاء اصطناعي وأنظمة أتمتة وخطوط أنابيب صوتية لتطوير المبيعات (SDR) لعملاء B2B. يكتب عن حزمة أدوات LLM التي يستخدمها فريق Techsy فعلياً في الإنتاج. تواصل معه على LinkedIn.
مؤسس مشارك، Techsy.io.
الأسئلة الشائعة
ما هو GPT-5.6 Sol Ultra؟
Sol Ultra هي فئة الجهد الاستدلالي الأعلى في GPT-5.6. ميزتها المحورية هي الوكلاء الفرعيون المتعاونون: منسّق يقسّم المهمة، ويتبادل الوكلاء الفرعيون الرسائل مع بعضهم أثناء العمل. توجّهها OpenAI للمهام الوكيلية الطويلة والصعبة متعددة الخطوات، لا التعديلات السريعة، وعرضتها كجزء من عائلة Sol في 26-06-2026.
هل Sol Ultra متاحة في Codex الآن؟
ليس لمعظم الناس. حتى يوليو 2026، لا تزال Sol Ultra في معاينة مغلقة يمكن الوصول إليها عبر OpenAI API وCodex، محصورة على نحو 20 شريكاً موثوقاً معتمداً من جهات حكومية خلف مراجعة سلامة. تقول OpenAI إن الوصول الأوسع "قادم في الأسابيع المقبلة" لكنها لم تنشر تاريخاً محدداً، فلا يمكنك تفعيلها ببساطة اليوم.
كيف تعمل الوكلاء الفرعيون المتعاونون في Sol Ultra؟
يقسّم منسّق مهمتك إلى أجزاء ويكلّف كل جزء لوكيل فرعي. وعلى عكس الوكلاء المتوازيين المستقلين، يتواصل هؤلاء الوكلاء أثناء المهمة، ويتشاركون ما يتعلمونه فيعدّل الآخرون قبل الانتهاء. هذا التنسيق يساعد في الأعمال المعقدة متعددة الملفات، لكن كل وكيل فرعي هو استدعاء نموذج مستقل يستهلك توكِناته الخاصة.
ما هو "أقصى جهد استدلال" في GPT-5.6؟
أقصى جهد استدلال هو الدرجة الأعلى في سلّم الجهد في GPT-5.6، الذي يمر بمنخفض ثم متوسط ثم مرتفع ثم الحد الأقصى. الجهد الأعلى يعني أن النموذج يقضي وقتاً حسابياً أطول في التفكير قبل الإجابة. يساعد في المهام الصعبة طويلة المدى ويهدر المال على المهام البسيطة، فتعامل معه كمقياس ترفعه فقط حين تكون المهمة صعبة فعلاً.
كم تكلّف تشغيل Sol Ultra؟
يُسعَّر Sol الأساسي بـ5 دولارات لكل مليون توكِن إدخال، و0.50 دولار للمُخبَّأة، و30 دولاراً لكل مليون توكِن إخراج (المصدر: DataCamp وdeeplearning.ai، بتاريخ منتصف 2026). تستحدث Ultra وكلاء فرعيين متعاونين، فتُطلق مهمة واحدة عدة استدعاءات نموذج. يُظهر مثالنا المُحاكى أن مهمة واحدة تكلّف تقريباً من 2x إلى 4x تكلفة تشغيل Sol الأساسي، بسبب توكِنات الإخراج الإضافية أساساً.
هل Sol Ultra أفضل فعلاً من Claude Mythos 5؟
بحسب الأرقام المنشورة، تتقدم Sol Ultra (91.9%) على Claude Mythos 5 في Terminal-Bench 2.1، لكن هذا غير موثّق. لم تنشر OpenAI الرقم، والمعاينة مغلقة، ورقم Mythos 5 نفسه يختلف من 84.3% إلى 88.0% حسب المصدر. فالجواب الصادق هو: لا نعرف بعد، ولا ينبغي أن توجّه حركة إنتاج فعلية بناءً عليه.
متى ستصبح Sol Ultra متاحة على نطاق عام؟
قالت OpenAI إن الوصول الأوسع لعائلة Sol عبر ChatGPT وCodex وواجهة API "قادم في الأسابيع المقبلة"، لكنها لم تنشر تاريخاً للإطلاق العام. أي تاريخ محدد يتداول على الإنترنت (بما فيه "7 يوليو") هو ثرثرة غير مؤكدة، لا إعلان رسمي. تابع صفحة معاينة OpenAI الرسمية لمعرفة الجدول الزمني المؤكد.
هل رقم 91.9% في Terminal-Bench 2.1 موثّق؟
لا. رقم 91.9% مصدره الصحافة الثانوية، لا صفحة معاينة OpenAI نفسها. المعاينة مغلقة على نحو 20 شريكاً، ولم يُكشف عن أي منهجية تقييم، فلا يستطيع أحد خارج تلك الدائرة إعادة إنتاجه. قد يثبت دقته لاحقاً، لكنه الآن ادّعاء صحفي غير موثّق، لا نتيجة مقياس محسومة.
كيف تختلف Sol Ultra عن الوكلاء المتوازيين في GPT-5.5 Pro؟
يعمل الوكلاء المتوازيون في Pro بشكل مستقل في مسارات منفصلة: كل واحد ينجز جزءه بمعزل عن الآخرين ويعيد نتيجة، دون أي تواصل. أما وكلاء Sol Ultra الفرعيون فيتعاونون، ويتبادلون الرسائل مع بعضهم في منتصف المهمة حتى يتمكنوا من التعديل وهم يتعلمون. هذا التنسيق يناسب الأعمال الأصعب متعددة الخطوات، لكنه يضاعف أيضاً استهلاك التوكِنات عبر الاستدعاءات.
هل أحتاج Sol Ultra، أم أن Sol الأساسي كافٍ؟
لمعظم أعمال البرمجة الوكيلية، يكفي Sol الأساسي أو جهد الاستدلال المرتفع، وبتكلفة أقل بكثير. احتفظ بـUltra للمهام الطويلة متعددة الملفات حيث سيكلّفك خطأ في المحاولة الأولى وقتاً أكثر من التوكِنات الإضافية. إن لم تستطع أن تفسّر بوضوح لماذا مهمتك صعبة، فأنت لا تحتاج Ultra لها. وجّه اختيارك حسب الصعوبة، لا حسب لوحة الترتيب.
ماذا يقول المطورون عن GPT-5.6 Sol على Reddit؟
تقارير r/codex المبكرة إيجابية بخصوص السرعة ("أسرع بمرتين") وإنجاز الطلبات من محاولة واحدة، مع عدد من المطورين يشبّهون الشعور بـClaude Fable 5. لكن المخضرمين يحذّرون من نمط "شهر العسل ثم التقليم" الذي تتراجع فيه النماذج بعد الإطلاق، ويتركز أكثر النقاش على التكلفة مقارنة بخطط Anthropic، لا على القدرة الخام.