
Claude Fable 5 مقابل Opus 4.8: هل يستحق التبديل؟ (فئة Mythos، مع المعايير)
أطلقت Anthropic Claude Fable 5 في 9 يونيو 2026، ولم تكن الأسابيع الستة التالية مسارًا مستقيمًا: تعليق بأمر حكومي، ثم استعادة كاملة، ثم تصحيح أمني، وإطلاق منافسَين جديدين. لا يزال النموذج يسجّل 80.3% على SWE-Bench Pro، وهو معيار البرمجة الوكيلية الذي يبلغ فيه Opus 4.8 نسبة 69.2% فيما يتأخر GPT-5.5 عند 58.6%. هذه ليست فجوة هامشية، رغم أن GPT-5.5 لم يعد النموذج الوحيد الذي يستحق مقارنته به. وثمة تفصيلة مهمة: Fable 5 هو النصف العام المحمي من نموذج جديد يُعرف بفئة "Mythos-class"، ويرافقه نموذج شقيق مقيّد يسمى Claude Mythos 5 لا يُتاح إلا عبر برنامج وصول مقيّد. فيما يلي ما تغيّر، وما حدث منذ الإطلاق، وما تكلّفه مهمة حقيقية بسعر $10/$50 لكل مليون رمز، وهل يستحق نقل حزمتك من Opus 4.8 فعلًا.
الإجابة السريعة
- Fable 5 يسجّل 80.3% على SWE-Bench Pro مقابل 69.2% لـ Opus 4.8 و58.6% لـ GPT-5.5، لكن Claude Sonnet 5 وGPT-5.6 Sol (كلاهما أُطلق بعد Fable 5) يُقلّصان جزءًا من تلك الفجوة في معايير البرمجة الوكيلية وسطر الأوامر.
- السعر: $10 للإدخال / $50 للإخراج لكل مليون رمز، أقل من نصف سعر Mythos Preview.
- Fable 5 يعود تلقائيًا إلى Opus 4.8 في الاستعلامات عالية المخاطر (إلكترونية/بيولوجية/كيميائية)؛ كما يحجب تحديث للمصنّف بتاريخ 1 يوليو أسلوب استدعاء اكتشفه باحثو Amazon، في أكثر من 99% من الحالات.
- عُلّق الوصول لكل المستخدمين بين 12 و30 يونيو 2026 بموجب ضوابط التصدير الأمريكية، ثم استُعيد بالكامل في 1 يوليو. كما اختفى التسعير المجاني حتى تاريخ محدد: تحتفظ خطتا Max وTeam Premium بـ Fable 5 ضمن الاشتراك، بينما تحصل خطتا Pro وTeam Standard على رصيد لمرة واحدة بقيمة $100 ثم أسعار API، وفقًا لـ TechTimes وXenoSpectrum (لم تؤكد Anthropic ذلك على موقعها الرسمي).
ما الذي أُطلق فعلًا: Fable 5 وMythos 5 وخط "Mythos-class"
Mythos-class هي فئة القدرات العليا الجديدة من Anthropic، وتأتي في نموذجين. Claude Fable 5 هو النسخة العامة المحمية التي يمكنك استدعاؤها الآن. Claude Mythos 5 هو النموذج الحدّي ذاته لكن دون الضمانات الوقائية، ويخضع لبرنامج وصول مقيّد. الدماغ واحد، والمسار إلى العلني مختلف.
هذا الانقسام هو جوهر القصة. وفقًا لـ إعلان Anthropic، يحتفظ Mythos 5 بالقدرة الكاملة على المستوى الحدّي بما يشمل مهارات الهجوم الإلكتروني التي قد تسبب ضررًا حقيقيًا، لذا لا توزّعه Anthropic على الجمهور. Fable 5 يأخذ النموذج نفسه ويُضيف مصنّفات تكتشف الطلبات عالية المخاطر وتُحوّلها بهدوء إلى Opus 4.8.
عندما تستدعي Fable 5 إذن، تحصل على تفكير بمستوى Mythos-class في كل ما لا يندرج تحت بند الخطر، ونموذج احتياطي أكثر أمانًا للجزء الضيّق الذي يندرج. وصفت CNBC الأمر بأن Anthropic أصدرت "ذكاءً اصطناعيًا شبيهًا بـ Mythos للعموم"، وهذا صحيح، لكن الآلية الدقيقة أهم من العنوان.
Fable 5 وMythos 5 هما النموذج الحدّي ذاته مقسومًا في نسختين: واحدة تستخدمها اليوم، وواحدة تحتفظ بها Anthropic خلف بوابة. Mythos-class هي الفئة؛ Fable وMythos هما بابا الدخول إليها.
ما الذي تغيّر مقارنةً بسلسلة Opus 4.x
في كل اختبار تقييم للبرمجة والاستدلال المشمول هنا، تتجاوز Fable 5 نتائج Opus 4.8 لا بفارق هامشي بل بفارق مزدوج الأرقام. SWE-Bench Pro يقفز من 69.2% إلى 80.3%، وهو رقم نشرته Anthropic وأكّدته بشكل مستقل كل من Vellum وllm-stats وWeights & Biases. FrontierCode Diamond ينتقل من 13.4 إلى 29.3، وهو رقم لا تنشره Anthropic نفسها؛ بل يأتي من رصد Vellum وllm-stats. انخفض السعر أيضًا، وأضاف النموذج ميزة ضبط جهد التفكير الجديدة. هذه خطوة حدّية حقيقية فوق سلسلة Opus 4.x، وليست مجرد إصدار نقطي.

المسح الشامل للـ13 معيارًا أعلاه هو النظرة السريعة. إليك المجموعة الرئيسية مقابل النماذج الثلاثة التي تُقارن بها معظم الفرق فعلًا:
| المعيار | Claude Fable 5 | Claude Opus 4.8 | GPT-5.5 |
|---|---|---|---|
| SWE-Bench Pro (برمجة وكيلية) | 80.3% | 69.2% | 58.6% |
| FrontierCode Diamond (أصعب مسائل البرمجة) | 29.3 | 13.4 | 5.7 |
| Terminal-Bench 2.1 (سطر أوامر وكيلي) | 88.0% | لا ينطبق | لا ينطبق |
| GPQA-AA (استدلال دراسات عليا، Elo) | 1932 | لا ينطبق | لا ينطبق |
| ExploitBench | 78.0% | لا ينطبق | لا ينطبق |
مرجع المقارنة هنا هو Claude Opus 4.8، النموذج الذي يحلّ Fable 5 محلّه على الحافة، والنموذج نفسه الذي يعود إليه Fable 5 في الاستعلامات عالية المخاطر. إذا تابعت سلسلة Opus 4.x عبر الإصدارين الأخيرين، كان النمط تحسينات تدريجية. Fable 5 يكسر ذلك النمط.
تحفّظان قبل أن تقرأ الجدول على أنه حقيقة مطلقة. أولًا، SWE-Bench Pro هو تقييم Anthropic الخاص المنشور، وقد تأكّد بشكل مستقل من مصادر أخرى؛ أما FrontierCode Diamond فليس رقمًا نشرته Anthropic إطلاقًا، بل هو معيار من طرف ثالث يرصده Vellum وllm-stats. ثانيًا، قرص ضبط جهد التفكير يعني أن رقم المعيار الواحد يخفي وراءه منحنى تكلفة. سنتناول ذلك في قسم التسعير لأنه يُغيّر الحسابات.
المعايير التي تهم المطوّرين فعلًا
أربعة أرقام تحمل الثقل العملي: SWE-Bench Pro 80.3%، وFrontierCode Diamond 29.3، وTerminal-Bench 2.1 88.0%، وGPQA-AA 1932 Elo. معًا تُغطّي العمل الفعلي على المستودعات، وأصعب مسائل البرمجة الاصطناعية، والمهام الوكيلية في سطر الأوامر، والاستدلال على مستوى الدراسات العليا. إذا كان حجم عملك يمسّ أيًا من هذه، فهذا القسم يُخبرك إذا كان الرقم ينطبق على وظيفتك.
الرسم البياني الرئيسي أعلى هذا المقال هو الدليل: SWE-Bench Pro 80.3 مقابل 69.2 مقابل 58.6، وFrontierCode 29.3 مقابل 13.4 مقابل 5.7. فماذا تقيس هذه الأرقام فعلًا؟
- SWE-Bench Pro يختبر قدرة النموذج على إرسال طلب سحب حقيقي إلى مستودع حقيقي: الاستنساخ، والفهم، والتصحيح، واجتياز الاختبارات. Fable 5 ينجح في 8 من كل 10 حالات. هذا أقرب مقياس لـ"هل يستطيع أداء وظيفتي الفعلية؟"
- Terminal-Bench 2.1 يقيّم مهام سطر الأوامر الوكيلية: تشغيل الأوامر، وقراءة المخرجات، والتعافي من الأخطاء. نسبة 88.0% مهمة إن كنت تبني وكلاء برمجة تعمل في سطر الأوامر.
- FrontierCode Diamond هو أعلى مستوى في مسائل البرمجة، تلك التي تسجّل فيها معظم النماذج أرقامًا أحادية. 29.3 منخفض بالقيمة المطلقة لكنه يزيد على ضعف نتيجة Opus 4.8 البالغة 13.4.
- GPQA-AA هو استدلال علمي بمستوى الدراسات العليا ويُقاس كتصنيف Elo. 1932 يُشير إلى استدلال متعدد الخطوات يتجاوز البرمجة.
في سير عمل Claude Code لدينا عبر سلسلة Opus 4.x، كانت القيود المتكررة في المهام الوكيلية طويلة الأمد: كان النموذج يفقد الخيط في منتصف تغيير يمتد على عدة ملفات. أرقام Terminal-Bench وSWE-Bench Pro لـ Fable 5 تُشير إلى أن هذا السقف تحرّك. هل تحرّك لـمستودعك تحديدًا فهذا هو الاختبار الوحيد المهم، لكن الأرقام المنشورة من النوع الصحيح.
حالات اختبار حقيقية: ما يستطيع Fable 5 فعله مما عجزت عنه النماذج السابقة
نشرت Anthropic ثلاثة أمثلة ملموسة تُظهر فئة المشكلات التي يعالجها Fable 5 الآن: ترحيل قاعدة كود Stripe المضغوط من أشهر إلى يوم واحد، وإكمال لعبة فيديو بالرؤية وحدها، وتحسن أداء ثلاثي عبر التحقق الذاتي. كل مثال يُشير إلى قدرة لم تستطع النماذج السابقة بلوغها. الأمثلة الثلاثة مصدرها Anthropic؛ نحن نستشهد بإعلانها لا باختبارات مستقلة.
إليك ما يُثبته كل مثال:
-
ترحيل Ruby لـ Stripe. تُفيد Anthropic بأن Fable 5 ضغط ترحيل قاعدة كود Ruby من نحو شهرين إلى يوم واحد تقريبًا. هذا هو حجم المشكلة التي يُغيّرها هذا النموذج. فئة الإعادة الشاملة طويلة الأمد هذه كانت تحتاج إلى فريق بشري يحمل قاعدة الكود بأكملها في رؤوسهم.
-
Pokémon FireRed بالرؤية فقط. وفقًا لـ Anthropic، أكمل Fable 5 لعبة Pokémon FireRed باستخدام الرؤية وحدها، بينما احتاجت النماذج السابقة إلى سقالات مخصصة معقدة لتغذية حالة اللعبة كنص. هذا تقدم في الاستدلال المكاني والبصري: النموذج يقرأ الشاشة ويتصرف، دون أي سقالة مساعدة.
-
Slay the Spire بأداء 3×. عند الجهد القصوى للتفكير، تقول Anthropic إن Fable 5 يتحقق من تحركاته بنفسه ووصل إلى أداء أفضل بمقدار 3× عبر الذاكرة المستمرة. الدرس ليس اللعبة؛ الدرس أن النموذج يراجع عمله على مدى أفق تخطيط طويل ويتحسن منه.
لا شيء من هذا ينبغي أن يُؤخذ على الثقة لحجم عملك. لكنه ينعكس بوضوح على التحسينات في الجدول: البرمجة طويلة الأمد (SWE-Bench Pro)، والاستدلال المكاني (الرؤية)، والتحقق الذاتي (قرص ضبط الجهد). الإنجازات النوعية والكمية تروي القصة ذاتها.
التسعير وحقيقة التكلفة لكل مهمة
Fable 5 يكلّف $10 لكل مليون رمز إدخال و**$50 لكل مليون رمز إخراج**. Anthropic تصوّر ذلك بأنه "أقل من نصف سعر Claude Mythos Preview". وهو أيضًا ضعف Opus 4.8 تقريبًا لكل رمز. كلاهما صحيح. المشكلة أن سعر الرمز هو الوحدة الخاطئة. ما تدفعه فعلًا مقابل مهمة منجزة، وهنا تبرز رياضيات Fable 5 المثيرة للاهتمام.

جهد التفكير قرص تضبطه لكل طلب. الجهد المنخفض يعني رموز استدلال داخلية أقل وإجابة أرخص وأسرع؛ الجهد الأقصى يعني أن النموذج يُفكّر أطول وينفق رموز إخراج أكثر ويسجّل درجات أعلى. يُظهر الرسم البياني أعلاه Fable 5 يتصاعد من ~11% إلى ~31% على FrontierCode مع تدرّج الجهد من المنخفض إلى الأقصى، بينما يبلغ Opus 4.8 ذروته عند ~13% ويبقى GPT-5.5 ثابتًا قرب 5-6%. إذن التكلفة لكل مهمة ليست رقمًا واحدًا؛ إنها منحنى تختار نقطة منه.
لنحسب مثالًا ملموسًا من التسعير المنشور $10/$50. هذا حساب رياضي من أسعار Anthropic المعلنة، وليس نتيجة معيار مُقيَّسة.
خذ استدعاءً وكيليًا واحدًا بـ50,000 رمز إدخال و15,000 رمز إخراج عند جهد عالٍ:
الإدخال: 50,000 / 1,000,000 × $10 = $0.50
الإخراج: 15,000 / 1,000,000 × $50 = $0.75
لكل استدعاء: $1.25المهمة الوكيلية الحقيقية تتسلسل من استدعاءات عديدة: قراءة المستودع، والتخطيط، والتعديل، وتشغيل الاختبارات، والإصلاح، وتكرار. لنفترض 12 استدعاءً بهذا الشكل: نحو $15 للمهمة المنجزة. عند الجهد الأقصى مع سياق أثقل، يضع منحنى تكلفة Anthropic الخاص مهام FrontierCode الصعبة أقرب إلى نطاق $20 للمهمة. شغّل المهمة ذاتها على GPT-5.5 وستدفع أقل لكل رمز. لكن إذا لم يستطع إنهاء المهمة عند أي مستوى جهد، فتكلفتك لكل مهمة منجزة لا نهائية. Fable 5 يكلّف أكثر لكل رمز من GPT-5.5، ومع ذلك يفوز في تكلفة المهمة المنجزة لأنه يُنجز عملًا يعجز عنه GPT-5.5.
إليك استدعاءً مبسّطًا. معرّف النموذج هو claude-fable-5 عبر الواجهة البرمجية (anthropic.claude-fable-5 على Bedrock). ابتداءً من الجيل 4.6، أصبحت معرّفات نماذج Anthropic خالية من التاريخ، كما يؤكد إعلان Anthropic ذلك، فلا حاجة إلى تتبّع اسم مستعار مؤرَّخ بإصدار، فهذه السلسلة هي اللقطة الثابتة ذاتها:
import anthropic
client = anthropic.Anthropic()
message = client.messages.create(
model="claude-fable-5", # dateless id; this is the pinned snapshot
max_tokens=4096,
thinking={"type": "enabled", "budget_tokens": 8000}, # reasoning effort
messages=[
{"role": "user", "content": "Migrate this module from Ruby 2.7 to 3.3 and run the tests."}
],
)
print(message.content)أطروحة الاقتصاد في سطر واحد: تدفع أكثر لكل رمز من GPT-5.5، لكنك تُنجز مهامًا يعجز عنها GPT-5.5 بأي سعر. للأعمال الكثيرة منخفضة المخاطر، الرياضيات تُفضّل نموذجًا أرخص. للبرمجة الوكيلية الصعبة، تُفضّل Fable 5.
انقسام الضمانات: لماذا يعود Fable إلى Opus 4.8
Fable 5 يُشغّل مصنّفات على كل طلب. عندما يكتشف استعلامًا عالي المخاطر (هجوم إلكتروني، بيولوجي، كيميائي، أو محاولات تقطير النموذج)، يعود إلى Opus 4.8 بدلًا من الإجابة بالقدرة الكاملة لفئة Mythos. تقول Anthropic إن هذا الرجوع يحدث في أقل من 5% من الجلسات، لذا لن يواجهه معظم المستخدمين. الهدف إبقاء القدرة الخطيرة خلف البوابة مع إبقاء العمل اليومي دون تأثير.
الرقم الأصعب هو معدل نجاح الهجوم: كم مرة يستطيع مهاجم آلي كسر حماية النموذج وإجباره على فعل ما لا ينبغي. الأقل أفضل. أجرت Gray Swan ومعهد أمن الذكاء الاصطناعي البريطاني (UK AI Security Institute) اختبارًا أحمر للوكلاء عند k=100 مع تفعيل التفكير، ووضعت النتائج رقمًا حقيقيًا للفجوة:
| النموذج | معدل نجاح الهجوم |
|---|---|
| Claude Fable 5 | 4.8% |
| Claude Opus 4.8 | 9.6% |
| GPT-5.5 | 30.8% |
| Gemini 3.1 Pro | 45.5% |
لا يزال Fable 5 يتصدّر المجال، لكن الفارق عن Opus 4.8 يبلغ نحو الضعف فقط، لا فجوة برتبة كاملة كما يُشاع أحيانًا. أما مقابل GPT-5.5 وGemini 3.1 Pro، فالفجوة أوسع بكثير، بين 6 و9 أضعاف.
لماذا يهمّك هذا؟ إذا نشرت وكيلًا بصلاحيات أدوات (سطر أوامر، نظام ملفات، شبكة)، فكسر الحماية ليس ردًا دردشيًا سيئًا، بل نموذجًا يُنفّذ أوامر حقيقية وجّهه المهاجم. معدل نجاح هجوم أقل من 5%، أي نحو نصف معدل Opus 4.8، لا يزال يستحق التبديل لأي عمل يمسّ أدوات فعلية. تناول تغطية IT Pro آلية الرجوع بالتفصيل تحديدًا لهذا السبب: إنها الميزة التي تُتيح نشر نموذج حدّي للعموم بأمان.
المقايضة هي زمن الاستجابة. إذا كان سير عملك يمسّ أدوات الأمان فعلًا، قد يندلع الرجوع في منتصف المهمة ويُبدّل النموذج عليك، وهو ما ينبغي التخطيط حوله.
Claude Mythos 5 وسؤال الاستخدام المزدوج
Claude Mythos 5 هو النموذج الشقيق المحجوب، النموذج ذاته دون الرجوع الوقائي. يحتفظ بقدرة الهجوم الإلكتروني التي يحجبها Fable 5، وهذا بالضبط سبب عدم إصداره للعموم. الوصول يمرّ عبر Project Glasswing، برنامج مدقَّق للمدافعين والباحثين ممن يحتاجون القدرة الكاملة. النموذج واحد، مساران مختلفان للإصدار: أحدهما مفتوح والآخر محجوب.

الرسم البياني يجعل الحجب مرئيًا. على تقييمات الهجوم الإلكتروني (Firefox، OSS-Fuzz، CyberGym، CyScenarioBench) يسجّل Mythos 5 نتائج 88.4، و24.0، و83.8، و38.7. Fable 5 يُعيد قيمة مسطّحة 0.0 على جميع التقييمات الأربعة. في التقييمات الإلكترونية الهجومية، يسجّل Mythos 5 ما يصل إلى 88.4 حيث يُعيد Fable 5 قيمة مسطّحة 0.0: انقسام الضمانات مرئيًا.
هذه الصفر ليست فجوة قدرة. إنها الرجوع يندلع في كل مرة، يحجب الطلب قبل أن يُجيب النموذج الحدّي. لاحظت TechCrunch التوقيت: Anthropic أصدرت هذا بعد أيام من تحذيرها من أن الذكاء الاصطناعي بات خطيرًا جدًا للإصدار المفتوح. انقسام Fable/Mythos هو الإجابة السياسية على ذلك التحذير: انشر القدرة، احجب الخطر.
لمعظم المطورين، Mythos 5 لا يعنيهم. لن تستوفي متطلبات Project Glasswing ولن تحتاج إلى ذلك. المهم أن النموذج الذي تستدعيه مُقيَّد عن قصد في نطاق ضيّق من المهام، وهذا بالتصميم.
ماذا حدث بعد الإطلاق: تعليق دام أسبوعين، ثم تصحيح أمني
الأسابيع الستة الأولى لـ Fable 5 لم تكن مسارًا مستقيمًا. بعد ثلاثة أيام من إطلاق 9 يونيو، طبّقت الحكومة الأمريكية ضوابط تصدير على أحدث نماذج Anthropic، وفي 12 يونيو 2026 عُلّق الوصول لكل المستخدمين في كل مكان، لأن Anthropic لم تملك وسيلة للتحقق من هوية من يستدعي الـ API فعلًا. جاءت الموافقة الحكومية في 26 يونيو، فاستُعيد Mythos 5 أولًا لمجموعة من المؤسسات الأمريكية المدقَّقة (لم تنشر Anthropic عددها). واكتملت الاستعادة للجميع في 1 يوليو 2026، في اليوم نفسه الذي أعادت فيه GitHub تفعيل Fable 5 في Copilot. راجع جدولنا الزمني الكامل للتعليق لتفاصيل الأحداث المتلاحقة.
كان ذلك التعليق مشكلة ترخيص، لا مشكلة أمان. وبمعزل عن تجميد ضوابط التصدير، اكتشف باحثو Amazon أسلوب استدعاء تجاوز ضمانات Fable 5 بما يكفي لاستخراج ثغرات برمجية كان من المفترض أن يحجبها المصنّف. لم تسحب Anthropic النموذج بسبب هذا؛ بل أطلقت إصلاحًا رافق استعادة 1 يوليو، وهو تحديث للمصنّف يحجب هذا الأسلوب تحديدًا في أكثر من 99% من الحالات، مع رجوع الباقي إلى Opus 4.8 كالمعتاد. مشكلتان مختلفتان، وإصلاحان مختلفان، وقعا في الأسبوع التقويمي نفسه، وهذا لا يعني أن أحدهما سبّب الآخر.
إذا كنت تخطّط للاعتماد على Fable 5 في أي شيء يواجه العملاء، فالدرس العملي أن شروط الإطلاق الأولى لنموذج حدّي لا تبقى ثابتة دائمًا بعد ستة أسابيع.
المشهد التنافسي تحرّك: GPT-5.6 وClaude Sonnet 5
مقارنة Fable 5 بـ GPT-5.5 وحده كانت منطقية في 9 يونيو. لم تعد كذلك اليوم. إطلاقان جديدان منذ ذلك الحين يُغيّران الحساب، وأكبرهما يأتي من تشكيلة Anthropic نفسها لا من منافس.
Claude Sonnet 5، الذي أُطلق في 30 يونيو 2026، هو الإغفال الأهم. سعره $3/$15 لكل مليون رمز في الوضع العادي، و$2/$10 كسعر تمهيدي حتى 31 أغسطس 2026، أي جزء يسير من سعر Fable 5 البالغ $10/$50. على SWE-Bench Pro يسجّل 63.2%، خلف Fable 5 (80.3%) وخلف Opus 4.8 (69.2%). لكن على Terminal-Bench 2.1 يبلغ 80.4%، متجاوزًا Opus 4.8 البالغ 74.6%، وتبلغ نتيجته على OSWorld-Verified 81.2%. نموذج من العائلة نفسها بخُمس سعر Fable 5 يتجاوز الرائد السابق على معيار وكيلي، تفصيلة لا يمكن لمقال "هل تُبدّل؟" أن يتجاهلها.
GPT-5.6، تحديث OpenAI الذي أُطلق في 9 يوليو 2026، يأتي في ثلاث فئات: Sol وTerra وLuna. سعر Sol هو $5/$30، أي نحو نصف تكلفة إدخال Fable 5، بينما Terra بسعر $2.50/$15 وLuna بسعر $1/$6. وجهًا لوجه، وفقًا لمقارنة معايير Vellum بتاريخ 9 يوليو:
| المعيار | GPT-5.6 Sol | Fable 5 |
|---|---|---|
| SWE-Bench Pro | 64.6% | 80.0% |
| Terminal-Bench 2.1 | 88.8% | 86.0% |
| Coding Agent Index | 80 | 77.2 |
| Agents' Last Exam | 53.6 | 40.5 |
| OSWorld | 62.6% (2.0) | 85.0% (Verified) |
يفوز Sol على Terminal-Bench وCoding Agent Index وAgents' Last Exam، ويُفيد أنه يستخدم أقل من نصف رموز الإخراج، وأقل من نصف الوقت، وتكلفة أقل بنحو الثلث لكل مهمة مقارنةً بـ Fable 5. لا يزال Fable 5 يفوز بوضوح على SWE-Bench Pro وOSWorld.
عند جمع كلا التحديثين، يتحوّل الحكم الصادق من "Fable 5 يكتسح المجال" إلى "Fable 5 يفوز في العمل الحقيقي على المستودعات واستخدام الحاسوب، ويخسر أرضية في المهام الوكيلية وسطر الأوامر والتكلفة أمام نماذج لم تكن موجودة عند نشر هذا المقال لأول مرة." إذا كان حجم عملك على شاكلة SWE-Bench، أي طلبات سحب حقيقية على مستودعات حقيقية، فـ Fable 5 لا يزال الخيار الأفضل. إذا كان على شاكلة سطر الأوامر والوكلاء، أو محدود الميزانية، فاختبر الحقل الأحدث قبل الالتزام. الإصدار التالي من Anthropic نفسه لا يزال سؤالًا مفتوحًا؛ راجع مقالنا عن موعد إصدار Claude Fable 6 لما يُوحي به نمط التسمية.
بشأن التسعير الحالي عبر العائلة: يعمل كل من Fable 5 وMythos 5 بسعر $10/$50 لكل مليون رمز، وOpus 4.8 بسعر $5/$25، وSonnet 5 بسعر $3/$15 (سعر تمهيدي $2/$10 حتى 31 أغسطس 2026)، وHaiku 4.5 بسعر $1/$5.
ماذا يعني هذا: هل تُبدّل؟
انتقل إلى Fable 5 للبرمجة الوكيلية الصعبة، والمهام متعددة الخطوات طويلة الأمد، والاستدلال البصري أو المكاني، وفي أي مكان ينتصر فيه إنجاز المهمة على توفير بضع سنتات لكل رمز. ابقَ على Opus 4.8 للأعمال الكثيرة الحساسة للتكلفة، أو لأي شيء يُطلق الرجوع على أي حال. هذا هو الإطار كاملًا. الباقي تطبيق حجم عملك على الجانب الصحيح منه.
عندما تفوز Fable 5:
- البرمجة الوكيلية الصعبة حيث يتوقف Opus 4.8؛ الفجوة في SWE-Bench Pro حقيقية
- المهام طويلة الأمد (إعادة الهياكل متعددة الملفات، وعمليات الترحيل) حيث يُجدي التحقق الذاتي
- أحجام العمل البصرية والمكانية
- أي وظيفة تستحق مهمتها المنجزة أكثر من تكاليف الرموز الإضافية
عندما لا تزال Opus 4.8 تفوز:
- الأعمال الكثيرة الحساسة للتكلفة حيث يسود سعر الرمز
- أحجام عمل الأمان/البيولوجي/الكيميائي، حيث يعود Fable 5 إلى Opus 4.8 على أي حال، فاستدعِه مباشرةً
- سير العمل الحساس للزمن الذي لا يتحمل تبديل نموذج في منتصف المهمة
| حالة الاستخدام | النموذج الموصى به |
|---|---|
| برمجة وكيلية صعبة / عمليات ترحيل | Claude Fable 5 |
| الرؤية / الاستدلال المكاني | Claude Fable 5 |
| تصنيف كثير منخفض التكلفة | Claude Opus 4.8 |
| أدوات الأمان / الفريق الأحمر | Claude Opus 4.8 (مباشرة) |
بشأن التوفر: صيغة "مجاني حتى تاريخ محدد" من الإطلاق اختفت. تأجّل موعد التسعير النهائي أربع مرات، من 22 يونيو ← 7 يوليو ← 12 يوليو ← 19 يوليو 2026، وحلّ قرار 20 يوليو محل التاريخ بتقسيم حسب الفئة بدلًا من ذلك: تحتفظ خطتا Max وTeam Premium بـ Fable 5 ضمن الاشتراك بشكل دائم عند 50% من حدود الخطة، بينما تنتقل خطتا Pro وTeam Standard إلى أرصدة استخدام، رصيد لمرة واحدة بقيمة $100 يليه أسعار API. هذا التقسيم أوردته TechTimes وXenoSpectrum وBasic Tutorials؛ ولم تنشره Anthropic على صفحة تسعيرها الخاصة، لذا عامله كخبر منقول لا كمؤكَّد. Fable 5 متاح عمومًا على Anthropic API وAWS Bedrock وGoogle Cloud/Vertex AI وMicrosoft Foundry وGitHub Copilot (أُعيد تفعيله في 1 يوليو 2026 وفقًا لـسجل تغييرات GitHub؛ ويحتاج مسؤولو خطط Business وEnterprise إلى تفعيله يدويًا، إذ تكون السياسة معطّلة افتراضيًا)، وتطبيقات Pro/Max/Team/Enterprise للمستهلكين. نافذة السياق مليون رمز، والحد الأقصى للإخراج 128 ألف رمز، وتاريخ حد المعرفة يناير 2026. تفصيلتان تستحقان الانتباه لمشتري المؤسسات: Fable 5 وMythos 5 هما نموذجان مشمولان بسياسة الاحتفاظ الإلزامي بالبيانات لمدة 30 يومًا من Anthropic، لذا لا يتوفران بخيار الاحتفاظ الصفري بالبيانات، ويحمل الاستدلال داخل الولايات المتحدة حصرًا مضاعِف تسعير 1.1x.
عن المؤلف
Mert Batur مؤسس مشارك لـ Techsy.io، حيث يبني الفريق وكلاء ذكاء اصطناعي، وأنظمة أتمتة، وخطوط صوتية وSDR لعملاء B2B. يكتب عن حزمة أدوات نماذج اللغة الكبيرة التي يستخدمها فريق Techsy في الإنتاج الفعلي. تواصل معه عبر LinkedIn.
مؤسس مشارك، Techsy.io
الأسئلة الشائعة
ما هو Claude Fable 5؟
Claude Fable 5 هو أول نموذج من فئة Mythos-class متاح للعموم من Anthropic، أُطلق في 9 يونيو 2026. يسجّل 80.3% على SWE-Bench Pro ويُشغّل مصنّفات ضمانات تعود إلى Opus 4.8 في الاستعلامات عالية المخاطر. يكلّف $10 إدخال / $50 إخراج لكل مليون رمز.
ما الفرق بين Fable 5 وMythos 5؟
كلاهما النموذج الحدّي ذاته بمسارين مختلفين للإصدار. Fable 5 عام ومحمي؛ يعود إلى Opus 4.8 في الاستعلامات الخطرة. Mythos 5 هو النسخة المحجوبة كاملة القدرة، لا يمكن الوصول إليها إلا عبر برنامج Project Glasswing من Anthropic للمدافعين والباحثين المدقَّقين.
هل Claude Fable 5 أفضل فعلًا من Opus 4.8؟
نعم في البرمجة الوكيلية الصعبة والرؤية والاستدلال المكاني: Fable 5 يبلغ 80.3% على SWE-Bench Pro مقابل 69.2% لـ Opus 4.8. لكن Opus 4.8 لا يزال يفوز في الأعمال الكثيرة الحساسة للتكلفة، وFable 5 يعود أصلًا إلى Opus 4.8 في موضوعات الأمان الإلكتروني/البيولوجي/الكيميائي. "الأفضل" يعتمد على حجم عملك.
كم يكلّف Claude Fable 5؟
Claude Fable 5 يكلّف $10 لكل مليون رمز إدخال و$50 لكل مليون رمز إخراج. Anthropic تصفه بأنه "أقل من نصف سعر Mythos Preview". هذا ضعف Opus 4.8 تقريبًا لكل رمز، لكن الحجة الاقتصادية قائمة على المهمة المنجزة، إذ يُنجز Fable 5 عملًا تعجز عنه النماذج الأرخص.
ما معنى نموذج من "فئة Mythos-class"؟
Mythos-class هو المستوى الأعلى قدرةً الجديد من Anthropic، أُطلق مع Fable 5 وMythos 5. يمثّل قفزة حدّية فوق سلسلة Opus 4.x في معايير البرمجة والاستدلال. Fable 5 وMythos 5 هما نسختا الإصدار من النموذج ذاته: واحدة عامة ومحمية، وأخرى محجوبة.
لماذا يعود Fable 5 إلى Opus 4.8؟
Fable 5 يُشغّل مصنّفات تكتشف الطلبات عالية المخاطر (هجوم إلكتروني، بيولوجي، كيميائي، أو تقطير النموذج) وتُحوّلها إلى Opus 4.8 بدلًا من الإجابة بالقدرة الكاملة لـ Mythos-class. يحدث هذا في أقل من 5% من الجلسات. في اختبار الفريق الأحمر الذي أجرته Gray Swan ومعهد أمن الذكاء الاصطناعي البريطاني، يمنح هذا المزيج Fable 5 معدل نجاح هجوم 4.8% مقابل 9.6% لـ Opus 4.8، وكلاهما متقدّم بوضوح على GPT-5.5 البالغ 30.8%.
هل يمكنني الوصول إلى Claude Mythos 5؟
على الأرجح لا. Mythos 5 محجوب خلف Project Glasswing، برنامج الوصول المدقَّق من Anthropic للمدافعين وباحثي الأمن ممن يحتاجون القدرة الكاملة على الهجوم الإلكتروني التي يحجبها Fable 5. معظم المطورين لن يستوفوا الشروط ولا يحتاجون إلى ذلك، إذ تُغطّي Fable 5 العمل الوكيلي والبرمجي اليومي.
أين يمكنني استخدام Claude Fable 5؟
Claude Fable 5 متاح عمومًا على Anthropic API وAWS Bedrock وGoogle Cloud/Vertex AI وMicrosoft Foundry وGitHub Copilot (أُعيد تفعيله في 1 يوليو 2026، بتفعيل يدوي لمسؤولي خطط Business/Enterprise)، وتطبيقات Pro/Max/Team/Enterprise للمستهلكين. لم يعد التسعير مجانيًا حتى تاريخ محدد: تحتفظ خطتا Max وTeam Premium به ضمن الاشتراك بشكل دائم، بينما تحصل خطتا Pro وTeam Standard على رصيد لمرة واحدة بقيمة $100 ثم أسعار API، وفقًا لما أوردته TechTimes وXenoSpectrum.
الخلاصة
Claude Fable 5 خطوة حدّية حقيقية فوق Opus 4.8: 80.3% مقابل 69.2% على SWE-Bench Pro، وضعف نتيجة FrontierCode، ومعدل نجاح هجوم 4.8% مقابل 9.6% لـ Opus 4.8 تحت اختبار الفريق الأحمر من Gray Swan ومعهد أمن الذكاء الاصطناعي البريطاني، ما يجعله لا يزال الخيار الأكثر أمانًا للوكلاء الذين يستخدمون الأدوات، رغم أن الفارق يبلغ نحو الضعف فقط، لا رتبة كاملة كما يُشاع أحيانًا. بدّل إليه للبرمجة الوكيلية الصعبة، والمهام طويلة الأمد، والعمل البصري؛ لكن راجع Claude Sonnet 5 وGPT-5.6 Sol أولًا إذا كان حجم عملك على شاكلة سطر الأوامر والوكلاء أو محدود الميزانية، إذ أُطلق كلاهما بعد Fable 5 ولم يكن أي منهما موجودًا للمقارنة عند الإطلاق. الوصول لم يعد مجانيًا حتى تاريخ محدد أيضًا: تحتفظ خطتا Max/Team Premium به ضمن الاشتراك، بينما تحصل خطتا Pro/Team Standard على رصيد لمرة واحدة ثم أسعار API. فريق Techsy يبني وكلاء إنتاجية على هذه الحزمة تحديدًا، تواصل معنا إن أردت مساعدة.