Techsy
اتصل بنا
ابدأ
العودة للمدونة
ai-machine-learning

معايير أداء GPT-5.5 Pro: الأرقام التي نشرتها OpenAI (وتلك التي لم تنشرها)

بقلم Mert Batur
Jun 25, 2026
13 قراءة
جدول المحتويات
معايير أداء GPT-5.5 Pro: الأرقام التي نشرتها OpenAI (وتلك التي لم تنشرها)

معايير أداء GPT-5.5 Pro: الأرقام التي نشرتها OpenAI (وتلك التي لم تنشرها)

أطلقت OpenAI نموذج GPT-5.5 Pro في 23 أبريل 2026 بسعر 30 دولارًا لكل مليون رمز مُدخَل و180 دولارًا لكل مليون رمز مُخرَج. هذا ما يعادل 6 أضعاف سعر الإصدار الأساسي GPT-5.5 البالغ 5/30 دولارات. مقابل هذا السعر تحصل على نسخة ذات حوسبة أعلى تسجّل 90.1% على BrowseComp. لكن هذا هو الجزء الذي لا يظهر في العناوين: جدول التقييمات الرسمي لـ OpenAI يترك خانة الترميز الخاصة بـ GPT-5.5 Pro فارغة تمامًا. وكذلك الحال مع استخدام الحاسوب، وكذلك السياق الطويل. لذا حين تبحث عن درجة SWE-Bench Pro للنموذج، لن تجد شيئًا. سحبنا الجدول المنشور وصنّفنا كل رقم بأنفسنا.

الإجابة السريعة:

  • GPT-5.5 Pro هو نسخة ذات حوسبة أعلى من GPT-5.5 (صدرت في 23 أبريل 2026)، وليس نموذجًا جديدًا.
  • يتصدر في التصفح (BrowseComp 90.1%) والرياضيات الحدودية، لكن OpenAI تركت خانات الترميز واستخدام الحاسوب والسياق الطويل فارغة.
  • في خانات الترميز المتاحة، يتخلف الإصدار الأساسي GPT-5.5 عن Claude Fable 5 (SWE-Bench Pro: 58.6% مقابل 80.3%).
  • Claude Fable 5 موقوف حاليًا (توجيه أمريكي للرقابة على الصادرات، منذ حوالي 12 يونيو 2026)، لذا تأتي انتصاراته مصحوبةً بتحفّظ "لا يمكن شراؤه الآن".

ملاحظة سريعة حول المنهجية، لأن الدقة أهم من السرعة في مقالة المعايير: الأرقام أدناه مُراجَعة مقابل جداول OpenAI وAnthropic المنشورة وورقة SWE-Bench Pro (arXiv 2509.16941). حيث يُفصح عن رقم بائع واحد فقط، نوضح ذلك. وحيث لم تنشر OpenAI درجة Pro على الإطلاق، نكتب "غير منشور" بدلًا من استبدالها بهدوء بالرقم الأساسي.

معايير GPT-5.5 Pro: ما نشرته OpenAI فعلًا

تغطي المعايير المنشورة لـ GPT-5.5 Pro شريحةً ضيّقة: التصفح، والرياضيات الحدودية، والعمل المهني المعرفي، وعلم الوراثة، والاستدلال الشامل. أجرت OpenAI كل تقييم بمستوى جهد استدلالي xhigh في بيئة بحثية، وهو ما يختلف عن الإعداد الافتراضي لـ ChatGPT في الإنتاج. الرقم البارز هو BrowseComp 90.1%، متقدمًا بوضوح على الإصدار الأساسي GPT-5.5 (84.4%).

إليك الجدول الشامل، مع عمود يوضح ما إذا كانت OpenAI قد نشرت درجة Pro منفصلة لكل اختبار:

المعيارما يختبرهGPT-5.5 ProGPT-5.5 الأساسيهل نُشرت درجة Pro؟ملاحظات
BrowseCompالتصفح الصعب / البحث عن المعلومات90.1%84.4%نعمأوضح تفوق لـ Pro على الأساسي
FrontierMath T1-3رياضيات صعبة52.4%51.7%نعميتجاوز Opus 4.7 المُبلَّغ عنه (43.8%)
FrontierMath T4رياضيات حدودية39.6%35.4%نعمأصعب مستوى رياضي
GDPvalالعمل المهني المعرفي82.3% (منسوب)84.9%نعم (منسوب)جدول OpenAI يضع Pro دون الأساسي
GeneBenchعلم الوراثة متعدد المراحل33.2% (منسوب)25.0%نعم (منسوب)"تُفيد OpenAI" بقفزة كبيرة
HLE (بدون أدوات)استدلال صعب شامل43.1%41.4%نعمدون Opus 4.7 المُبلَّغ عنه (46.9%)
HLE (مع أدوات)استدلال بمساعدة الأدوات57.2% (منسوب)52.2%جزئيالأساسي 52.2% مؤكَّد؛ Pro 57.2% منسوب
Investment Banking Modelingالنمذجة المالية88.6% (داخلي)88.5%تقييم داخليوصفته OpenAI بـ INTERNAL؛ اعتبره مرونًا
SWE-Bench Proالترميز الوكيليغير منشور58.6%لاالفجوة الرئيسية
OSWorld-Verifiedاستخدام الحاسوبغير منشور78.7%لاخانة فارغة لـ Pro
Cybersecurityمهام الأمنغير منشورغير منشورلاخانة فارغة لـ Pro
Long-contextاسترجاع الوثائق الطويلةغير منشورغير منشورلاخانة فارغة لـ Pro

اقرأ الكتلة السفلية بعناية. نشرت OpenAI درجات GPT-5.5 Pro للتصفح والرياضيات، لكنها تركت خانات الترميز واستخدام الحاسوب والأمن السيبراني والسياق الطويل فارغة. أرقام BrowseComp وFrontierMath وGDPval الأساسية مؤكَّدة عبر متتبّعين مستقلين؛ أما GDPval-Pro (82.3%) وGeneBench (33.2%) ورقم Investment Banking فقد أفادت بها OpenAI دون تحقق مستقل، لذا ننسبها لمصدرها بدلًا من إيرادها كحقائق مطلقة.

ما الذي يعنيه "Pro" فعلًا: حوسبة متوازية في وقت الاختبار، وليس نموذجًا جديدًا

GPT-5.5 Pro هو نفس نموذج GPT-5.5 يعمل بجهد استدلالي أعلى بكثير، وليس بنية مختلفة. فكّر فيه كمحرك واحد يعمل لوقت أطول وبشكل متوازٍ قبل أن يُجيب. تسمّي OpenAI هذا الإعداد reasoning effort (جهد الاستدلال)، ويثبّته Pro عند المستوى الأعلى: xhigh.

هل GPT-5.5 Pro نموذج مختلف عن GPT-5.5؟

لا. نفس الأوزان، نفس التدريب. حين يبحث الناس عن gpt 5.5 pro vs gpt 5.5 thinking أو vs xhigh، فهم يسألون في الحقيقة عن مؤشر واحد: مدى عمق تفكير النموذج قبل الرد. "الحوسبة المتوازية في وقت الاختبار" تعني أن النموذج يستكشف عدة مسارات استدلالية في آنٍ واحد ثم يختار الأفضل، وهو ما يكلّف رموزًا أكثر ووقتًا فعليًا أطول. هذه الحوسبة الإضافية هي ما تدفع 6 أضعاف ثمنًا مقابله.

المواصفات متشابهة فيما عدا ذلك. يحمل GPT-5.5 Pro نافذة سياق تبلغ تقريبًا 1.1 مليون رمز إدخال و128 ألف رمز إخراج. لذا لا تشتري ذاكرة أكبر ولا نموذجًا أساسيًا أذكى. أنت تشتري وقت تفكير أطول على النموذج الذي تعرفه مسبقًا.

GPT-5.5 Pro مقابل GPT-5.5 القياسي: أين يُجدي السعر المضاعف 6 مرات؟

يتفوق GPT-5.5 Pro على الإصدار الأساسي في المهام الأصعب: التصفح، والرياضيات الحدودية، وعلم الوراثة. ويكاد لا يضيف شيئًا على العمل الاعتيادي. أوضح مكسب هو BrowseComp: 90.1% مقابل 84.4%، أي ارتفاع 5.7 نقاط في البحث العميق على الويب. وفي FrontierMath Tier 4 يرتفع إلى 39.6% من 35.4%.

لكن المزيد من الحوسبة لا يعني دائمًا درجة أعلى. في GDPval، يُدرج جدول OpenAI Pro فعلًا دون الإصدار الأساسي (82.3% منسوب مقابل 84.9% مؤكَّد). هذا مناقض للحدس، ومُبلَّغ به بوصفه مقايضة يجريها Pro بين بعض الانتصارات الخامّ والمعايرة. المغزى واضح: دفع المزيد لا يضمن نتيجة أفضل.

حيث يتقدم Pro:

  • BrowseComp: 90.1% مقابل 84.4% (+5.7)
  • FrontierMath T4: 39.6% مقابل 35.4% (+4.2)
  • GeneBench: 33.2% مقابل 25.0% (منسوب لـ OpenAI)
  • HLE مع أدوات: 57.2% (منسوب) مقابل 52.2% (الأساسي مؤكَّد)

حيث يستوي أو يتراجع:

  • GDPval: 82.3% (منسوب) مقابل 84.9% أساسي
  • HLE بدون أدوات: 43.1% مقابل 41.4%، تحسّن طفيف

إذا كان عملك يتمحور أساسًا حول الكتابة اليومية ومراجعة الكود والتلخيص، فيصعب تبرير السعر المضاعف 6 مرات. الحساب لا ينقلب إلا حين تكون المهمة صعبة فعلًا. وبينما نحن في موضوع التكلفة: إذا كانت فاتورتك هي المشكلة، يتناول دليلنا تخفيض تكاليف LLM API توجيه النماذج الأرخص للـ 80% السهلة والاحتفاظ بـ Pro للـ 20% الصعبة.

GPT-5.5 Pro vs Claude Fable 5

في معايير الترميز التي أفصح عنها الطرفان، يتغلب Claude Fable 5 على الإصدار الأساسي GPT-5.5 بفارق واضح. لكن Fable 5 موقوف حاليًا، لذا يأتي هذا الانتصار بتحفّظ. والمقارنة أكثر تعقيدًا مما تبدو، إذ لم تنشر OpenAI درجات ترميز GPT-5.5 Pro أصلًا. لذا المواجهة الأمينة هي فعلًا Fable 5 مقابل الإصدار الأساسي GPT-5.5 في الترميز، مع غياب Pro.

إليك الجدول الثلاثي. أرقام Fable 5 منسوبة لـ جدول Anthropic المنشور؛ والخانات الفارغة لـ Pro هي كذلك تمامًا:

الاختبارGPT-5.5 الأساسيGPT-5.5 ProClaude Fable 5الفائز
SWE-Bench Pro58.6%غير منشور80.3%Fable 5
FrontierCode Diamond5.7%غير منشور29.3%Fable 5
Terminal-Bench83.4% (v2.1)غير منشور88.0% (v2.1)Fable 5
OSWorld-Verified78.7%غير منشور85.0%Fable 5
HLE (بدون أدوات)41.4%43.1%56.8–59.0%Fable 5
HLE (مع أدوات)52.2%57.2% (منسوب)64.5%Fable 5
BrowseComp84.4%90.1%غير منشورGPT-5.5 Pro
FrontierMath T435.4%39.6%غير مُبلَّغ عنهGPT-5.5 Pro
GDPval-AA1769غير منشور1932Fable 5

ثمة تحفّظان في هذا الجدول. أولًا، Terminal-Bench: يُسجّل الإصدار الأساسي GPT-5.5 درجة 82.7% على v2.0 و83.4% على v2.1، في حين أن درجة Fable 88.0% على v2.1، لذا تحقق من تطابق الإصدار قبل الإعلان عن فارق. ثانيًا، GDPval-AA ليس نسبة مئوية؛ بل درجة على غرار Elo (1932 لـ Fable مقابل 1769 للإصدار الأساسي GPT-5.5)، وهو مقياس مختلف تمامًا لا تصطفّه مع صفوف النسب المئوية في ذهنك. كما يتفاوت رقم HLE بدون أدوات لـ Fable بحسب المصدر: CodingFleet يُدرج 56.8% وملخصات أخرى تذكر 59.0%، لذا نُورد النطاق.

SWE-Bench Pro هو المعيار المحوري للترميز الوكيلي. يُشغِّل 1,865 مشكلة عبر 41 مستودعًا نشطًا (وفقًا لـ arXiv 2509.16941)، بمهام تستغرق مهندسًا كبيرًا ساعات أو أيامًا وتتطلب تعديلات متعددة الملفات. في هذا الاختبار، الفارق بين 80.3% لـ Fable 5 و58.6% للإصدار الأساسي GPT-5.5 كبير.

والآن التحفّظ. أُوقف Claude Fable 5 في يونيو 2026 بموجب توجيه أمريكي للرقابة على الصادرات (حوالي 12 يونيو). لذا "Fable يفوز في الترميز" صحيح على الأرقام ومعلّق حاليًا عند نقطة الشراء. إذا أردت الصورة الأعمق من جانب Anthropic، فهذا هو تحليلنا الكامل لـ Claude Fable 5. وللاطلاع على النموذج الذي يقيس جدول GPT-5.5 مقارنته بالرياضيات، راجع Claude Opus 4.8.

المعايير التي لم تنشرها OpenAI لـ Pro

لم تُصدر OpenAI قط درجات GPT-5.5 Pro للترميز (SWE-Bench Pro)، أو استخدام الحاسوب (OSWorld-Verified)، أو الأمن السيبراني، أو استرجاع السياق الطويل، أو الاستدلال المجرد. هذه الخانات فارغة في الجدول الرسمي. الفراغ لا يعني أن النموذج ضعيف فيها؛ بل يعني ببساطة أنه لا يوجد رقم منشور، وأي شخص يستشهد بأرقام إما يخمّن أو يُسيء الاستشهاد بالدرجة الأساسية.

هذا الأمر مهم لأنه الفجوة الأكثر بحثًا. إذا بحثت عن درجة SWE-Bench Pro لـ GPT-5.5 Pro، فلن تجدها — لم تنشرها OpenAI قط. الرقم الوحيد الموجود لهذا المعيار في عائلة GPT-5.5 هو درجة النموذج الأساسي 58.6%، وهي رقم أساسي لا رقم Pro. نُنبّه إلى ذلك عن قصد.

ما يمكننا قوله بمسؤولية:

  • الترميز (SWE-Bench Pro): Pro غير منشور. الإصدار الأساسي GPT-5.5 = 58.6% (أساسي، ليس Pro).
  • استخدام الحاسوب (OSWorld-Verified): Pro غير منشور. الأساسي = 78.7% (أساسي، ليس Pro).
  • الأمن السيبراني: Pro غير منشور، ولا بديل أساسي صالح في الجدول.
  • السياق الطويل: Pro غير منشور، ولا بديل أساسي صالح.
  • الاستدلال المجرد: Pro غير منشور.

هل يمكن لحوسبة Pro المتوازية أن ترفع هذه الأرقام الأساسية؟ على الأرجح نعم، بالنظر إلى النمط في التصفح والرياضيات. لكن "على الأرجح" ليس معيارًا، ولن نطبع رقمًا لم تنشره OpenAI. هذا التحفّظ بالذات هو سبب وجود هذا القسم.

التسعير: 5/30 دولارًا مقابل 30/180 دولارًا مقابل 10/50 دولارًا — هل Pro يستحق 6 أضعاف؟

تكلّف GPT-5.5 Pro تقريبًا 6 أضعاف الإصدار الأساسي GPT-5.5: 30 دولارًا للإدخال و180 دولارًا للإخراج لكل مليون رمز، مقابل 5/30 دولارات للأساسي. Claude Fable 5 يقع بينهما بـ 10/50 دولارات. يستحق السعر للبحث الصعب والرياضيات الحدودية، ونادرًا ما يستحق للعمل الاعتيادي.

النموذجالإدخال / 1Mالإخراج / 1Mالتكلفة النسبية
GPT-5.5 الأساسي$5$301× (الأساس)
Claude Fable 5$10$50~2× إدخال، ~1.7× إخراج
GPT-5.5 Pro$30$180~6× الأساسي

من الذي يجب أن يدفع هذا المبلغ الإضافي؟ حكم تقريبي حسب الوظيفة:

  • البحث الصعب والرياضيات الحدودية والتصفح العميق متعدد الخطوات: GPT-5.5 Pro يكسب حقه. المكاسب في المعايير حقيقية وقيمة المهمة عالية.
  • الترميز الوكيلي على المستودعات الكبيرة: Fable 5 إذا كان متاحًا، وإلا فالإصدار الأساسي GPT-5.5 ملفوفًا بإطار ترميز. الدفع بأسعار Pro مقابل درجة ترميز غير منشورة رهان خاسر.
  • الكتابة اليومية والتلخيص ومراجعة الكود والدعم: الإصدار الأساسي GPT-5.5. السعر المضاعف 6 مرات لا يشتري شيئًا تقريبًا هنا.

الفخ هو تحديد كل شيء على Pro "لضمان الجودة". في أحمال العمل الكثيفة بالإخراج يتراكم رقم 180 دولارًا بسرعة. التوجيه حسب صعوبة المهمة يحافظ على معظم الجودة بجزء من الفاتورة (المزيد في دليل تكاليف LLM API).

كيف تحققنا من هذه الأرقام (وأين تختلف المصادر)

قبل أن يدخل أي من هذه الأرقام إلى هذا المقال، أنجزنا الجزء غير اللامع: سحبنا جدول تقييمات GPT-5.5 المنشور من OpenAI وراجعنا كل صف Pro مقابل متتبّعين مستقلين بدلًا من الاعتماد على لقطة شاشة واحدة. المصادر التي استخدمناها للمقارنة هي: llm-stats وBenchLM وتحليل DataCamp لـ Fable 5 وCodingFleet وورقة arXiv لـ SWE-Bench Pro (2509.16941). إليك ما صمد وما لم يصمد.

معظم الأرقام الرئيسية لـ Pro تتوافق بوضوح. BrowseComp 90.1%، وFrontierMath Tier 1–3 (52.4%) وTier 4 (39.6%)، وتسعير 30/180 دولارًا، كل هذه تطابقت عبر كل المصادر التي فحصناها. SWE-Bench Pro بنسبة 80.3% لـ Fable 5 مقابل 58.6% للإصدار الأساسي GPT-5.5، وFrontierCode Diamond بنسبة 29.3% مقابل 5.7%، كذلك تحققت — وعدد مهام SWE-Bench Pro (1,865 مشكلة عبر 41 مستودعًا) مأخوذ مباشرةً من الورقة البحثية لا من مدونة الشركة.

ثلاثة أمور لم تتوافق، وينبغي أن تعلمها:

  • "Humanity's Last Exam" بالأدوات لـ Fable 5 يظهر بأي رقم بين 56.8% و59.0% بحسب المصدر. نستشهد بالنطاق بدلًا من اختيار رقم.
  • أرقام Terminal-Bench تتأرجح بين الإصدارين 2.0 و2.1 عبر جداول OpenAI وAnthropic، لذا الفارق بين GPT-5.5 (83.4%) وFable (88.0%) ليس مقارنة متكافئة تمامًا.
  • درجة Investment Banking Modeling (88.6% Pro) موسومة بـ "internal" من قِبل OpenAI، أي لا يستطيع أي متتبّع مستقل التحقق منها. ننبّه إلى كونها ادعاء مزوّد في كل مرة نذكرها فيها.

هذه هي النسخة الأمينة. الأرقام التي نعرضها كحقائق تحققت عبر مصدرَين مستقلَّين على الأقل؛ وكل ما عدا ذلك ننسبه لمن أفاد به. لم نُشغِّل GPT-5.5 Pro بأنفسنا — بتسعير 30/180 دولارًا لكل مليون رمز، إجراء مواجهة جادة ليس شيئًا سندّعيه، لذا لن نتظاهر بأن لدينا نتائج مختبرية ليست في حوزتنا.

نتائج حقيقية تُبلّغ عنها الشركات

هذه ادعاءات الشركات لا نتائج مختبرات مستقلة، لذا اعتبرها دليلًا ذا صلة بالتسويق. نشرت كل من OpenAI وAnthropic دراسات حالة تُقدّم صورة مُختارة. نُدرجها منسوبةً مع تحفّظ بأننا لم نتحقق من أيٍّ منها.

من جانب OpenAI، تقول الشركة إن فريق مالي استخدم Codex مع GPT-5.5 لمراجعة 24,771 نموذج ضريبي K-1 (71,637 صفحة)، وأنهى العمل بنحو أسبوعين أسرع من العملية المعتادة. تُشير OpenAI أيضًا إلى تطبيق هندسة جبر متعدد الأوجه بُني من مطالبة واحدة في 11 دقيقة، وتحليل لـ GPT-5.5 Pro لمجموعة بيانات تعبير جيني تضم 62 عينة وحوالي 28,000 جين.

من جانب Anthropic، استخدمت Stripe (مُبلَّغًا عبر Anthropic) نموذج Fable 5 لتنفيذ ترحيل شامل لقاعدة شفرات Ruby بالغة 50 مليون سطر في يوم واحد، مقابل تقدير بأكثر من شهرَين يدويًا. تقول Anthropic أيضًا إن Fable 5 أكمل Pokémon FireRed انطلاقًا من لقطات شاشة خام، حيث احتاج نماذج Claude السابقة إلى أدوات إطار إضافية، وأنه مع ذاكرة مستمرة قائمة على الملفات لعب Slay the Spire بأداء أفضل بنحو 3 أضعاف مقارنةً بـ Opus 4.8.

عروض مثيرة للإعجاب، جميعها. تذكّر فقط أنها اختيرت من قِبل الشركات ولا يمكن إعادة إنتاجها من البيانات الصحفية وحدها.

أي نموذج يجب أن تستخدم فعلًا؟

طابق النموذج مع المهمة، لا مع الضجيج. للوكلاء البرمجيين والمستودعات الكبيرة، استخدم Claude Fable 5 إذا كان متاحًا، والإصدار الأساسي GPT-5.5 ملفوفًا بإطار ترميز إذا لم يكن. للبحث والرياضيات الحدودية والتصفح العميق، GPT-5.5 Pro هو الاختيار. للعمل اليومي وكفاءة التكلفة، الإصدار الأساسي GPT-5.5 يكسب بالقيمة في معظم الأوقات.

بعض الإرشادات إذا كنت تختار منظومة لا مجرد استدعاء واحد. إذا أردت نظامًا برمجيًا مستقلًا فعلًا، فأنت بحاجة إلى أداة لا نموذج خام، لذا ابدأ بـ أفضل وكلاء الترميز بالذكاء الاصطناعي 2026 ومراجعة مقارنة وكلاء الترميز في الخلفية للحصول على سياق Codex وDevin. فضولي حول مسار العائلة؟ إليك ما يتسرّب عن GPT-5.6.

في Techsy نوجّه المهام عبر خطوط الوكلاء لدينا — نماذج استدلال عالية الجودة للنداءات الصعبة ونماذج أرخص للباقي — بدلًا من دفع أسعار مميزة على كل طلب. إذا أردت رأيًا ثانيًا حول مزيج النماذج الخاص بك، احصل على استشارة مجانية.

عن الكاتب

Mert Batur هو المؤسس المشارك لـ Techsy.io، حيث يعمل الفريق على بناء وكلاء ذكاء اصطناعي وأنظمة أتمتة وخطوط إنتاج صوتية وSDR للعملاء B2B. يكتب عن منظومة أدوات LLM التي يستخدمها فريق Techsy فعليًا في الإنتاج. تواصل عبر LinkedIn.

الأسئلة الشائعة

هل GPT-5.5 Pro يستحق سعره؟

يعتمد على المهمة. للبحث الصعب والرياضيات الحدودية والتصفح العميق، تُبرّر مكاسب GPT-5.5 Pro على الإصدار الأساسي (BrowseComp 90.1% مقابل 84.4%) السعر المضاعف بنحو 6 أضعاف البالغ 30/180 دولارًا لكل مليون رمز. للكتابة اليومية ومراجعة الكود والتلخيص، يمنحك الإصدار الأساسي GPT-5.5 تقريبًا نفس الجودة بسدس التكلفة.

هل GPT-5.5 Pro أفضل من Claude Fable 5؟

في معايير الترميز المنشورة، لا: Claude Fable 5 يتغلب على الإصدار الأساسي GPT-5.5 في SWE-Bench Pro (80.3% مقابل 58.6%)، ولم تنشر OpenAI أي درجة ترميز لـ Pro للمقارنة. GPT-5.5 Pro يتفوق في التصفح والرياضيات الحدودية. تحفّظ واحد: Fable 5 موقوف حاليًا بموجب توجيه أمريكي للرقابة على الصادرات، لذا التوفّر مهم بقدر المعيار.

ما مدى براعة GPT-5.5 Pro في الترميز؟

بصراحة، لا يمكننا الإجابة من أرقام OpenAI، لأن OpenAI لم تنشر درجة ترميز لـ GPT-5.5 Pro. الرقم الوحيد المتاح للعائلة هو نتيجة SWE-Bench Pro للإصدار الأساسي GPT-5.5 البالغة 58.6%، والتي تتخلف عن 80.3% لـ Claude Fable 5. أي شخص يستشهد بـ "معيار ترميز Pro" يستشهد على الأرجح بالرقم الأساسي عن طريق الخطأ.

GPT-5.5 Pro مقابل GPT-5.5 القياسي — أيهما أستخدم؟

استخدم GPT-5.5 Pro للبحث الصعب والرياضيات الحدودية والتصفح العميق متعدد الخطوات، حيث يستحق الحوسبة المتوازية الإضافية السعر المضاعف 6 مرات. استخدم الإصدار الأساسي GPT-5.5 للعمل اليومي ومراجعة الكود والتلخيص حيث لا تكاد تُعوّض الأسعار المميزة شيئًا. في بعض الاختبارات كـ GDPval، يُدرج جدول OpenAI Pro دون الأساسي حتى.

كم يكلّف GPT-5.5 Pro؟

يكلّف GPT-5.5 Pro 30 دولارًا لكل مليون رمز إدخال و180 دولارًا لكل مليون رمز إخراج، أي ما يعادل تقريبًا 6 أضعاف سعر الإصدار الأساسي GPT-5.5 البالغ 5/30 دولارات. للمقارنة، Claude Fable 5 بـ 10/50 دولارات. في أحمال العمل الكثيفة بالإخراج يتراكم فارق الأسعار بسرعة، لذا التوجيه حسب صعوبة المهمة بدلًا من التحديد الافتراضي على Pro يوفّر مالًا حقيقيًا.

ما هو "xhigh" في جهد الاستدلال؟

جهد الاستدلال هو المؤشر الذي يتحكم في عمق تفكير GPT-5.5 قبل الرد. "xhigh" هو المستوى الأعلى، حيث يستخدم النموذج الحوسبة المتوازية في وقت الاختبار لاستكشاف عدة مسارات استدلالية واختيار الأفضل. أجرت OpenAI تقييمات GPT-5.5 Pro المنشورة عند xhigh في بيئة بحثية، وهو ما يختلف عن الإعداد الافتراضي لـ ChatGPT في الإنتاج.

هل GPT-5.5 Pro متاح في Codex؟

نعم. يمكنك استدعاء GPT-5.5 Pro في Codex CLI باستخدام سلسلة النموذج gpt-5.5-pro، وتعيين جهد الاستدلال على xhigh للحصول على أعلى سلوك حسابي. توقع زمن استجابة أطول وتكلفة رموز أعلى ملحوظة مقارنةً بالإصدار الأساسي GPT-5.5، لذا احتفظ به للمهام الصعبة فعلًا بدلًا من تشغيله كنموذج الترميز الافتراضي.

هل GPT-5.5 Pro نموذج جديد؟

لا. GPT-5.5 Pro هو نفس نموذج GPT-5.5 يعمل بجهد استدلالي أكبر وحوسبة متوازية في وقت الاختبار عند إعداد xhigh، وليس بنية منفصلة. يشترك في نفس الأوزان ونفس نافذة السياق البالغة تقريبًا 1.1 مليون رمز إدخال و128 ألف رمز إخراج. أنت تدفع مقابل وقت تفكير أطول، لا مقابل نموذج أساسي أذكى.

ما حجم نافذة السياق في GPT-5.5 Pro؟

تبلغ نافذة سياق GPT-5.5 Pro تقريبًا 1.1 مليون رمز إدخال و128 ألف رمز إخراج، وهي نفسها للإصدار الأساسي GPT-5.5. هذا يكفي لتحميل قواعد شفرات كبيرة أو وثائق طويلة في استدعاء واحد. الفارق بين Pro والأساسي ليس في حجم الذاكرة؛ بل في مقدار حوسبة الاستدلال التي يُنفقها النموذج قبل الرد.

الوسوم

GPT-5.5 Pro benchmarksGPT-5.5 Pro vs FableSWE-Bench ProBrowseCompLLM models

شارك هذا المقال

مقالات ذات صلة

المزيد في ai-machine-learning

ai-machine-learning
Aug 8, 2026

الجلسات والتتبعات والفترات في مراقبة LLM: أحدها ليس مستوى بنيويًا

الجلسات والتتبعات والفترات تتداخل في مراقبة LLM، لكن مواصفات OpenTelemetry GenAI لا تعرّف سوى اثنين منها كمستويات بنيوية. قرأنا وثائق خمسة مزودين والمواصفات نفسها لتحديد مكان كل مفهوم فعليًا.

13 دقيقة قراءة قراءة
اقرأ
ai-machine-learning
Aug 8, 2026

نشر نموذج LLM على GPU بدون خادم: 5 منصات، أسعار حقيقية، وبدايات باردة صادقة

خمس منصات GPU بدون خادم بمقارنة أسعار بالدولار لكل ساعة GPU، مع أرقام البداية الباردة التي لا ينشرها المزودون، وإجابة سؤال تخزين النماذج الذي لا يجيب عنه أحد.

12 دقيقة قراءة قراءة
اقرأ
ai-machine-learning
Aug 7, 2026

أنماط سير عمل وكلاء الذكاء الاصطناعي: 7 أنماط ومتى يتفوّق كلٌّ منها فعليًّا (2026)

سبعة أنماط لسير عمل وكلاء الذكاء الاصطناعي تتكرّر في كل تصنيفات المورّدين، لكن لا يوجد نمط واحد يفوز في كل الحالات. هذه المقالة ترتّبها استنادًا إلى بيانات معايير 2026 المنشورة من Google Research وAnthropic، مع عرض الحسابات، وكود Python قابل للتشغيل لكل شكل، وسلّم قرار لاختيار النمط المناسب.

13 دقيقة قراءة قراءة
اقرأ
عرض جميع المقالات
ابدأ مشروعك

هل أنت مستعد لبناء شيء استثنائي؟

دعنا نحول رؤيتك إلى واقع. فريقنا جاهز لمساعدتك في إنشاء برمجيات تصنع الفرق.

احجز مكالمة استكشاف لمدة 30 دقيقةشاهد أعمالنا

الأحدث من المكتبة

Claude Skills

عرض الكل
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

أتمتة الذكاء الاصطناعي

عرض الكل
  • مُدقّق الأمن

    فحص SCA وIaC أسبوعي مع PRs إصلاح مرتّبة الأولوية.

  • كاتب البريد البارد

    ينشئ رسائل أول تواصل مبنية على تفصيل عام واحد محدّد.

  • وكيل بحث العملاء المحتملين

    يثري بريداً إلكترونياً إلى ملف، ويقيّم الملاءمة، وينبّه في Slack.

الأحدث من المكتبة

Claude Skills

عرض الكل
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

أتمتة الذكاء الاصطناعي

عرض الكل
  • مُدقّق الأمن

    فحص SCA وIaC أسبوعي مع PRs إصلاح مرتّبة الأولوية.

  • كاتب البريد البارد

    ينشئ رسائل أول تواصل مبنية على تفصيل عام واحد محدّد.

  • وكيل بحث العملاء المحتملين

    يثري بريداً إلكترونياً إلى ملف، ويقيّم الملاءمة، وينبّه في Slack.

الخدمات

  • حلول المؤسسات
  • تطبيقات الجوال
  • تطبيقات الويب

الحلول

  • أنظمة إدارة علاقات العملاء
  • تكامل الذكاء الاصطناعي
  • حلول تخطيط الموارد
  • المساعدون الصوتيون
  • أتمتة العمليات
  • الأمن السيبراني

المكتبة

  • المدونة
  • أعمالنا

المجتمع

  • أتمتة الذكاء الاصطناعي
  • Claude Skills

الأدوات

  • حاسبة تكلفة تطبيق الجوال
  • حاسبة تكلفة OpenAI / LLM API
  • حاسبة تكلفة MVP
  • حاسبة تكلفة الوكيل الصوتي بالذكاء الاصطناعي

الشركة

  • من نحن
  • الشركاء
  • اتصل بنا

قانوني

  • سياسة الخصوصية
  • شروط الخدمة
  • سياسة ملفات تعريف الارتباط

الخدمات

  • حلول المؤسسات
  • تطبيقات الجوال
  • تطبيقات الويب

الحلول

  • أنظمة إدارة علاقات العملاء
  • تكامل الذكاء الاصطناعي
  • حلول تخطيط الموارد
  • المساعدون الصوتيون
  • أتمتة العمليات
  • الأمن السيبراني

المكتبة

  • المدونة
  • أعمالنا

المجتمع

  • أتمتة الذكاء الاصطناعي
  • Claude Skills

الأدوات

  • حاسبة تكلفة تطبيق الجوال
  • حاسبة تكلفة OpenAI / LLM API
  • حاسبة تكلفة MVP
  • حاسبة تكلفة الوكيل الصوتي بالذكاء الاصطناعي

الشركة

  • من نحن
  • الشركاء
  • اتصل بنا
قانونيسياسة الخصوصيةشروط الخدمةسياسة ملفات تعريف الارتباط
TECHSY
© 2026 Techsy. جميع الحقوق محفوظة.