
Claude Fable 5 مقابل Opus 4.8: هل يستحق التبديل؟ (فئة Mythos، مع المعايير)
أطلقت Anthropic Claude Fable 5 اليوم، 9 يونيو 2026. يسجّل النموذج 80.3% على SWE-Bench Pro، وهو معيار البرمجة الوكيلية الذي يبلغ فيه Opus 4.8 نسبة 69.2% فيما يتأخر GPT-5.5 عند 58.6%. الفجوة ليست هامشًا للتقريب. وثمة تفصيلة مهمة: Fable 5 هو النصف العام المحمي من فئة نماذج جديدة تُعرف بـ"Mythos-class"، ويرافقه نموذج شقيق مقيّد يسمى Claude Mythos 5 لا يمكن الوصول إليه إلا عبر برنامج وصول مقيّد. فيما يلي ما تغيّر، وما تكلّفه مهمة حقيقية بسعر $10/$50 لكل مليون رمز، وهل يستحق نقل كودك من Opus 4.8.
الإجابة السريعة
- Fable 5 يسجّل 80.3% على SWE-Bench Pro مقابل 69.2% لـ Opus 4.8 و58.6% لـ GPT-5.5.
- السعر: $10 للإدخال / $50 للإخراج لكل مليون رمز، أقل من نصف سعر Mythos Preview.
- Fable 5 يعود تلقائيًا إلى Opus 4.8 في الاستعلامات عالية المخاطر (إلكترونية/بيولوجية/كيميائية)، وهذا يحدث في أقل من 5% من الجلسات.
- متاح مجانًا على خطط Pro/Max/Team/Enterprise حتى 22 يونيو 2026؛ تُطبَّق أرصدة الاستخدام بدءًا من 23 يونيو.
ما الذي أُطلق فعلًا: Fable 5 وMythos 5 وخط "Mythos-class"
Mythos-class هي فئة القدرات العليا الجديدة من Anthropic، وتأتي في نموذجين. Claude Fable 5 هو النسخة العامة المحمية التي يمكنك استدعاؤها الآن. Claude Mythos 5 هو النموذج الحدّي ذاته لكن دون الضمانات الوقائية، ويخضع لبرنامج وصول مقيّد. الدماغ واحد، والمسار إلى العلني مختلف.
هذا الانقسام هو جوهر القصة. وفقًا لـ إعلان Anthropic، يحتفظ Mythos 5 بالقدرة الكاملة على المستوى الحدّي بما يشمل مهارات الهجوم الإلكتروني التي قد تسبب ضررًا حقيقيًا، لذا لا توزّعه Anthropic على الجمهور. Fable 5 يأخذ النموذج نفسه ويُضيف مصنّفات تكتشف الطلبات عالية المخاطر وتُحوّلها بهدوء إلى Opus 4.8.
عندما تستدعي Fable 5 إذن، تحصل على تفكير بمستوى Mythos-class في كل ما لا يندرج تحت بند الخطر، ونموذج احتياطي أكثر أمانًا للجزء الضيّق الذي يندرج. وصفت CNBC الأمر بأن Anthropic أصدرت "ذكاءً اصطناعيًا شبيهًا بـ Mythos للعموم"، وهذا صحيح، لكن الآلية الدقيقة أهم من العنوان.
Fable 5 وMythos 5 هما النموذج الحدّي ذاته مقسومًا في نسختين: واحدة تستخدمها اليوم، وواحدة تحتفظ بها Anthropic خلف بوابة. Mythos-class هي الفئة؛ Fable وMythos هما بابا الدخول إليها.
ما الذي تغيّر مقارنةً بسلسلة Opus 4.x
في كل اختبار تقييم للبرمجة والاستدلال نشرته Anthropic، تتجاوز Fable 5 نتائج Opus 4.8 بفارق مزدوج الأرقام لا بفارق هامشي. SWE-Bench Pro يقفز من 69.2% إلى 80.3%. FrontierCode Diamond ينتقل من 13.4 إلى 29.3. انخفض السعر أيضًا، وأضاف النموذج ميزة ضبط جهد التفكير. هذه خطوة حدّية حقيقية فوق سلسلة Opus 4.x، ليست مجرد إصدار نقطي.

المسح الشامل للـ13 معيارًا أعلاه هو النظرة السريعة. إليك المجموعة الرئيسية مقابل النماذج الثلاثة التي تُقارن بها معظم الفرق فعلًا:
| المعيار | Claude Fable 5 | Claude Opus 4.8 | GPT-5.5 |
|---|---|---|---|
| SWE-Bench Pro (برمجة وكيلية) | 80.3% | 69.2% | 58.6% |
| FrontierCode Diamond (أصعب مسائل البرمجة) | 29.3 | 13.4 | 5.7 |
| Terminal-Bench 2.1 (سطر أوامر وكيلي) | 88.0% | لا ينطبق | لا ينطبق |
| GPQA-AA (استدلال دراسات عليا، Elo) | 1932 | لا ينطبق | لا ينطبق |
| ExploitBench | 78.0% | لا ينطبق | لا ينطبق |
مرجع المقارنة هنا هو Claude Opus 4.8، النموذج الذي يحلّ Fable 5 محلّه على الحافة، والنموذج نفسه الذي يعود إليه Fable 5 في الاستعلامات عالية المخاطر. إذا تابعت سلسلة Opus 4.x عبر الإصدارين الأخيرين، كان النمط تحسينات تدريجية. Fable 5 يكسر ذلك النمط.
تحفّظان قبل أن تقرأ الجدول على أنه حقيقة مطلقة. أولًا، هذه تقييمات Anthropic الخاصة المنشورة، وليست اختبارات مستقلة. ثانيًا، قرص ضبط جهد التفكير يعني أن رقم المعيار الواحد يخفي وراءه منحنى تكلفة. سنتناول ذلك في قسم التسعير لأنه يُغيّر الحسابات.
المعايير التي تهم المطوّرين فعلًا
أربعة أرقام تحمل الثقل العملي: SWE-Bench Pro 80.3%، وFrontierCode Diamond 29.3، وTerminal-Bench 2.1 88.0%، وGPQA-AA 1932 Elo. معًا تُغطّي العمل الفعلي على المستودعات، وأصعب مسائل البرمجة الاصطناعية، والمهام الوكيلية في سطر الأوامر، والاستدلال على مستوى الدراسات العليا. إذا كان حجم عملك يمسّ أيًا من هذه، فهذا القسم يُخبرك إذا كان الرقم ينطبق على وظيفتك.
الرسم البياني الرئيسي أعلى هذا المقال هو الدليل: SWE-Bench Pro 80.3 مقابل 69.2 مقابل 58.6، وFrontierCode 29.3 مقابل 13.4 مقابل 5.7. فماذا تقيس هذه الأرقام فعلًا؟
- SWE-Bench Pro يختبر قدرة النموذج على إرسال طلب سحب حقيقي إلى مستودع حقيقي: الاستنساخ، والفهم، والتصحيح، واجتياز الاختبارات. Fable 5 ينجح في 8 من كل 10 حالات. هذا أقرب مقياس لـ"هل يستطيع أداء وظيفتي الفعلية؟"
- Terminal-Bench 2.1 يقيّم مهام سطر الأوامر الوكيلية: تشغيل الأوامر، وقراءة المخرجات، والتعافي من الأخطاء. نسبة 88.0% مهمة إن كنت تبني وكلاء برمجة تعمل في سطر الأوامر.
- FrontierCode Diamond هو أعلى مستوى في مسائل البرمجة، تلك التي تسجّل فيها معظم النماذج أرقامًا أحادية. 29.3 منخفض بالقيمة المطلقة لكنه يزيد على ضعف نتيجة Opus 4.8 البالغة 13.4.
- GPQA-AA هو استدلال علمي بمستوى الدراسات العليا ويُقاس كتصنيف Elo. 1932 يُشير إلى استدلال متعدد الخطوات يتجاوز البرمجة.
في سير عمل Claude Code لدينا عبر سلسلة Opus 4.x، كانت القيود المتكررة في المهام الوكيلية طويلة الأمد: كان النموذج يفقد الخيط في منتصف تغيير يمتد على عدة ملفات. أرقام Terminal-Bench وSWE-Bench Pro لـ Fable 5 تُشير إلى أن هذا السقف تحرّك. هل تحرّك لـمستودعك تحديدًا فهذا هو الاختبار الوحيد المهم، لكن الأرقام المنشورة من النوع الصحيح.
حالات اختبار حقيقية: ما يستطيع Fable 5 فعله مما عجزت عنه النماذج السابقة
نشرت Anthropic ثلاثة أمثلة ملموسة تُظهر فئة المشكلات التي يعالجها Fable 5 الآن: ترحيل قاعدة كود Stripe المضغوط من أشهر إلى يوم واحد، وإكمال لعبة فيديو بالرؤية وحدها، وتحسن أداء ثلاثي عبر التحقق الذاتي. كل مثال يُشير إلى قدرة لم تستطع النماذج السابقة بلوغها. الأمثلة الثلاثة مصدرها Anthropic؛ نحن نستشهد بإعلانها لا باختبارات مستقلة.
إليك ما يُثبته كل مثال:
-
ترحيل Ruby لـ Stripe. تُفيد Anthropic بأن Fable 5 ضغط ترحيل قاعدة كود Ruby من نحو شهرين إلى يوم واحد تقريبًا. هذا هو حجم المشكلة التي يُغيّرها هذا النموذج. فئة الإعادة الشاملة طويلة الأمد هذه كانت تحتاج إلى فريق بشري يحمل قاعدة الكود بأكملها في رؤوسهم.
-
Pokémon FireRed بالرؤية فقط. وفقًا لـ Anthropic، أكمل Fable 5 لعبة Pokémon FireRed باستخدام الرؤية وحدها، بينما احتاجت النماذج السابقة إلى سقالات مخصصة معقدة لتغذية حالة اللعبة كنص. هذا تقدم في الاستدلال المكاني والبصري: النموذج يقرأ الشاشة ويتصرف، دون أي سقالة مساعدة.
-
Slay the Spire بأداء 3×. عند الجهد القصوى للتفكير، تقول Anthropic إن Fable 5 يتحقق من تحركاته بنفسه ووصل إلى أداء أفضل بمقدار 3× عبر الذاكرة المستمرة. الدرس ليس اللعبة؛ الدرس أن النموذج يراجع عمله على مدى أفق تخطيط طويل ويتحسن منه.
لا شيء من هذا ينبغي أن يُؤخذ على الثقة لحجم عملك. لكنه ينعكس بوضوح على التحسينات في الجدول: البرمجة طويلة الأمد (SWE-Bench Pro)، والاستدلال المكاني (الرؤية)، والتحقق الذاتي (قرص ضبط الجهد). الإنجازات النوعية والكمية تروي القصة ذاتها.
التسعير وحقيقة التكلفة لكل مهمة
Fable 5 يكلّف $10 لكل مليون رمز إدخال و**$50 لكل مليون رمز إخراج**. Anthropic تصوّر ذلك بأنه "أقل من نصف سعر Claude Mythos Preview". وهو أيضًا ضعف Opus 4.8 تقريبًا لكل رمز. كلاهما صحيح. المشكلة أن سعر الرمز هو الوحدة الخاطئة. ما تدفعه فعلًا مقابل مهمة منجزة، وهنا تبرز رياضيات Fable 5 المثيرة للاهتمام.

جهد التفكير قرص تضبطه لكل طلب. الجهد المنخفض يعني رموز استدلال داخلية أقل وإجابة أرخص وأسرع؛ الجهد الأقصى يعني أن النموذج يُفكّر أطول وينفق رموز إخراج أكثر ويسجّل درجات أعلى. يُظهر الرسم البياني أعلاه Fable 5 يتصاعد من ~11% إلى ~31% على FrontierCode مع تدرّج الجهد من المنخفض إلى الأقصى، بينما يبلغ Opus 4.8 ذروته عند ~13% ويبقى GPT-5.5 ثابتًا قرب 5-6%. إذن التكلفة لكل مهمة ليست رقمًا واحدًا؛ إنها منحنى تختار نقطة منه.
لنحسب مثالًا ملموسًا من التسعير المنشور $10/$50. هذا حساب رياضي من أسعار Anthropic المعلنة، وليس نتيجة معيار مُقيَّسة.
خذ استدعاءً وكيليًا واحدًا بـ50,000 رمز إدخال و15,000 رمز إخراج عند جهد عالٍ:
الإدخال: 50,000 / 1,000,000 × $10 = $0.50
الإخراج: 15,000 / 1,000,000 × $50 = $0.75
لكل استدعاء: $1.25المهمة الوكيلية الحقيقية تتسلسل من استدعاءات عديدة: قراءة المستودع، والتخطيط، والتعديل، وتشغيل الاختبارات، والإصلاح، وتكرار. لنفترض 12 استدعاءً بهذا الشكل: نحو $15 للمهمة المنجزة. عند الجهد الأقصى مع سياق أثقل، يضع منحنى تكلفة Anthropic الخاص مهام FrontierCode الصعبة أقرب إلى نطاق $20 للمهمة. شغّل المهمة ذاتها على GPT-5.5 وستدفع أقل لكل رمز. لكن إذا لم يستطع إنهاء المهمة عند أي مستوى جهد، فتكلفتك لكل مهمة منجزة لا نهائية. Fable 5 يكلّف أكثر لكل رمز من GPT-5.5، ومع ذلك يفوز في تكلفة المهمة المنجزة لأنه يُنجز عملًا يعجز عنه GPT-5.5.
إليك استدعاءً مبسّطًا. يُعطي إعلان Anthropic claude-fable-5 كمعرّف النموذج؛ تحقق من السلسلة المُؤرَّخة الدقيقة في وثائق Anthropic API قبل النشر، إذ تختلف الأسماء المستعارة أحيانًا:
import anthropic
client = anthropic.Anthropic()
message = client.messages.create(
model="claude-fable-5", # verify exact dated id in API docs
max_tokens=4096,
thinking={"type": "enabled", "budget_tokens": 8000}, # reasoning effort
messages=[
{"role": "user", "content": "Migrate this module from Ruby 2.7 to 3.3 and run the tests."}
],
)
print(message.content)أطروحة الاقتصاد في سطر واحد: تدفع أكثر لكل رمز من GPT-5.5، لكنك تُنجز مهامًا يعجز عنها GPT-5.5 بأي سعر. للأعمال الكثيرة منخفضة المخاطر، الرياضيات تُفضّل نموذجًا أرخص. للبرمجة الوكيلية الصعبة، تُفضّل Fable 5.
انقسام الضمانات: لماذا يعود Fable إلى Opus 4.8
Fable 5 يُشغّل مصنّفات على كل طلب. عندما يكتشف استعلامًا عالي المخاطر (هجوم إلكتروني، بيولوجي، كيميائي، أو محاولات تقطير النموذج)، يعود إلى Opus 4.8 بدلًا من الإجابة بالقدرة الكاملة لفئة Mythos. تقول Anthropic إن هذا الرجوع يحدث في أقل من 5% من الجلسات، لذا لن يواجهه معظم المستخدمين. الهدف إبقاء القدرة الخطيرة خلف البوابة مع إبقاء العمل اليومي دون تأثير.

الرقم الأصعب هو معدل نجاح الهجوم: كم مرة يستطيع مهاجم آلي كسر حماية النموذج وإجباره على فعل ما لا ينبغي. الأقل أفضل. تُظهر نتائج الفريق الأحمر لـ Anthropic انخفاضًا حادًا عبر الإصدارات: من Opus 4.6 بنسبة 83.2%، إلى Opus 4.7 بنسبة 72.7%، إلى Opus 4.8 بنسبة 56.6%، وصولًا إلى Fable 5 بنسبة 5.4%. نجحت الهجمات ضد Fable 5 بنسبة 5.4% فقط، انخفاضًا من 56.6% على Opus 4.8.
لماذا يهمّك هذا؟ إذا نشرت وكيلًا بصلاحيات أدوات (سطر أوامر، نظام ملفات، شبكة)، فكسر الحماية ليس ردًا دردشيًا سيئًا، بل نموذجًا يُنفّذ أوامر حقيقية وجّهه المهاجم. معدل نجاح هجوم بنسبة 5.4% يعني أنه أصعب بعشر مرات تقريبًا في الإساءة إليه مقارنةً بـ Opus 4.8. تناول تغطية IT Pro آلية الرجوع بالتفصيل تحديدًا لهذا السبب: إنها الميزة التي تُتيح نشر نموذج حدّي للعموم بأمان.
المقايضة هي زمن الاستجابة. إذا كان سير عملك يمسّ أدوات الأمان فعلًا، قد يندلع الرجوع في منتصف المهمة ويُبدّل النموذج عليك، وهو ما ينبغي التخطيط حوله.
Claude Mythos 5 وسؤال الاستخدام المزدوج
Claude Mythos 5 هو النموذج الشقيق المحجوب، النموذج ذاته دون الرجوع الوقائي. يحتفظ بقدرة الهجوم الإلكتروني التي يحجبها Fable 5، وهذا بالضبط سبب عدم إصداره للعموم. الوصول يمرّ عبر Project Glasswing، برنامج مدقَّق للمدافعين والباحثين ممن يحتاجون القدرة الكاملة. النموذج واحد، مساران مختلفان للإصدار: أحدهما مفتوح والآخر محجوب.

الرسم البياني يجعل الحجب مرئيًا. على تقييمات الهجوم الإلكتروني (Firefox، OSS-Fuzz، CyberGym، CyScenarioBench) يسجّل Mythos 5 نتائج 88.4، و24.0، و83.8، و38.7. Fable 5 يُعيد قيمة مسطّحة 0.0 على جميع التقييمات الأربعة. في التقييمات الإلكترونية الهجومية، يسجّل Mythos 5 ما يصل إلى 88.4 حيث يُعيد Fable 5 قيمة مسطّحة 0.0: انقسام الضمانات مرئيًا.
هذه الصفر ليست فجوة قدرة. إنها الرجوع يندلع في كل مرة، يحجب الطلب قبل أن يُجيب النموذج الحدّي. لاحظت TechCrunch التوقيت: Anthropic أصدرت هذا بعد أيام من تحذيرها من أن الذكاء الاصطناعي بات خطيرًا جدًا للإصدار المفتوح. انقسام Fable/Mythos هو الإجابة السياسية على ذلك التحذير: انشر القدرة، احجب الخطر.
لمعظم المطورين، Mythos 5 لا يعنيهم. لن تستوفي متطلبات Project Glasswing ولن تحتاج إلى ذلك. المهم أن النموذج الذي تستدعيه مُقيَّد عن قصد في نطاق ضيّق من المهام، وهذا بالتصميم.
ماذا يعني هذا: هل تُبدّل؟
انتقل إلى Fable 5 للبرمجة الوكيلية الصعبة، والمهام متعددة الخطوات طويلة الأمد، والاستدلال البصري أو المكاني، وفي أي مكان ينتصر فيه إنجاز المهمة على توفير بضع سنتات لكل رمز. ابقَ على Opus 4.8 للأعمال الكثيرة الحساسة للتكلفة، أو لأي شيء يُطلق الرجوع على أي حال. هذا هو الإطار كاملًا. الباقي تطبيق حجم عملك على الجانب الصحيح منه.
عندما تفوز Fable 5:
- البرمجة الوكيلية الصعبة حيث يتوقف Opus 4.8؛ الفجوة في SWE-Bench Pro حقيقية
- المهام طويلة الأمد (إعادة الهياكل متعددة الملفات، وعمليات الترحيل) حيث يُجدي التحقق الذاتي
- أحجام العمل البصرية والمكانية
- أي وظيفة تستحق مهمتها المنجزة أكثر من تكاليف الرموز الإضافية
عندما لا تزال Opus 4.8 تفوز:
- الأعمال الكثيرة الحساسة للتكلفة حيث يسود سعر الرمز
- أحجام عمل الأمان/البيولوجي/الكيميائي، حيث يعود Fable 5 إلى Opus 4.8 على أي حال، فاستدعِه مباشرةً
- سير العمل الحساس للزمن الذي لا يتحمل تبديل نموذج في منتصف المهمة
| حالة الاستخدام | النموذج الموصى به |
|---|---|
| برمجة وكيلية صعبة / عمليات ترحيل | Claude Fable 5 |
| الرؤية / الاستدلال المكاني | Claude Fable 5 |
| تصنيف كثير منخفض التكلفة | Claude Opus 4.8 |
| أدوات الأمان / الفريق الأحمر | Claude Opus 4.8 (مباشرة) |
بشأن التوفر: Fable 5 مجاني على خطط Pro/Max/Team/Enterprise حتى 22 يونيو 2026، وتُطبَّق أرصدة الاستخدام بدءًا من 23 يونيو. متاح عمومًا على Anthropic API وAWS Bedrock وGitHub Copilot وفقًا لـGitHub changelog، وكذلك Harvey. يمكنك إذن اختبار التبديل في محررك اليوم دون تغيير أي شيء في الفوترة.
عن المؤلف
Mert Batur Gurbuz مؤسس مشارك لـ Techsy.io، حيث يبني الفريق وكلاء ذكاء اصطناعي، وأنظمة أتمتة، وخطوط صوتية وSDR لعملاء B2B. يدرس في جامعة Birmingham ويكتب عن حزمة أدوات نماذج اللغة الكبيرة التي يستخدمها فريق Techsy في الإنتاج الفعلي. تواصل معه عبر LinkedIn.
مؤسس مشارك، Techsy.io · جامعة Birmingham
الأسئلة الشائعة
ما هو Claude Fable 5؟
Claude Fable 5 هو أول نموذج من فئة Mythos-class متاح للعموم من Anthropic، أُطلق في 9 يونيو 2026. يسجّل 80.3% على SWE-Bench Pro ويُشغّل مصنّفات ضمانات تعود إلى Opus 4.8 في الاستعلامات عالية المخاطر. يكلّف $10 إدخال / $50 إخراج لكل مليون رمز.
ما الفرق بين Fable 5 وMythos 5؟
كلاهما النموذج الحدّي ذاته بمسارين مختلفين للإصدار. Fable 5 عام ومحمي؛ يعود إلى Opus 4.8 في الاستعلامات الخطرة. Mythos 5 هو النسخة المحجوبة كاملة القدرة، لا يمكن الوصول إليها إلا عبر برنامج Project Glasswing من Anthropic للمدافعين والباحثين المدقَّقين.
هل Claude Fable 5 أفضل فعلًا من Opus 4.8؟
نعم في البرمجة الوكيلية الصعبة والرؤية والاستدلال المكاني: Fable 5 يبلغ 80.3% على SWE-Bench Pro مقابل 69.2% لـ Opus 4.8. لكن Opus 4.8 لا يزال يفوز في الأعمال الكثيرة الحساسة للتكلفة، وFable 5 يعود أصلًا إلى Opus 4.8 في موضوعات الأمان الإلكتروني/البيولوجي/الكيميائي. "الأفضل" يعتمد على حجم عملك.
كم يكلّف Claude Fable 5؟
Claude Fable 5 يكلّف $10 لكل مليون رمز إدخال و$50 لكل مليون رمز إخراج. Anthropic تصفه بأنه "أقل من نصف سعر Mythos Preview". هذا ضعف Opus 4.8 تقريبًا لكل رمز، لكن الحجة الاقتصادية قائمة على المهمة المنجزة، إذ يُنجز Fable 5 عملًا تعجز عنه النماذج الأرخص.
ما معنى نموذج من "فئة Mythos-class"؟
Mythos-class هو المستوى الأعلى قدرةً الجديد من Anthropic، أُطلق مع Fable 5 وMythos 5. يمثّل قفزة حدّية فوق سلسلة Opus 4.x في معايير البرمجة والاستدلال. Fable 5 وMythos 5 هما نسختا الإصدار من النموذج ذاته: واحدة عامة ومحمية، وأخرى محجوبة.
لماذا يعود Fable 5 إلى Opus 4.8؟
Fable 5 يُشغّل مصنّفات تكتشف الطلبات عالية المخاطر (هجوم إلكتروني، بيولوجي، كيميائي، أو تقطير النموذج) وتُحوّلها إلى Opus 4.8 بدلًا من الإجابة بالقدرة الكاملة لـ Mythos-class. يحدث هذا في أقل من 5% من الجلسات. خفّض ذلك معدل نجاح الهجوم الآلي من 56.6% (Opus 4.8) إلى 5.4%.
هل يمكنني الوصول إلى Claude Mythos 5؟
على الأرجح لا. Mythos 5 محجوب خلف Project Glasswing، برنامج الوصول المدقَّق من Anthropic للمدافعين وباحثي الأمن ممن يحتاجون القدرة الكاملة على الهجوم الإلكتروني التي يحجبها Fable 5. معظم المطورين لن يستوفوا الشروط ولا يحتاجون إلى ذلك، إذ تُغطّي Fable 5 العمل الوكيلي والبرمجي اليومي.
أين يمكنني استخدام Claude Fable 5؟
Claude Fable 5 متاح عمومًا على Anthropic API وAWS Bedrock وGitHub Copilot وHarvey. مجاني على خطط Pro وMax وTeam وEnterprise حتى 22 يونيو 2026؛ تُطبَّق أرصدة الاستخدام بدءًا من 23 يونيو. يمكنك اختباره في محررك أو عبر API اليوم.
الخلاصة
Claude Fable 5 خطوة حدّية حقيقية فوق Opus 4.8: 80.3% مقابل 69.2% على SWE-Bench Pro، وضعف نتيجة FrontierCode، ومعدل نجاح هجوم بنسبة 5.4% يجعله أكثر أمانًا بكثير للنشر مع الأدوات. انتقل إليه للبرمجة الوكيلية الصعبة والمهام طويلة الأمد والعمل البصري. ابقَ على Opus 4.8 للأحجام الكثيرة الحساسة للتكلفة أو أي شيء يُطلق الرجوع على أي حال. متاح مجانًا حتى 22 يونيو، فيمكنك اختبار التبديل قبل أن يُكلّفك شيئًا. فريق Techsy يبني وكلاء إنتاجية على هذه الحزمة تحديدًا، تواصل معنا إن أردت مساعدة.