
Qwen3.8-Max هنا: 2.4 تريليون معامل، سياق مليون رمز، والأوزان لم تصدر بعد
$1.4728. هذا ما كلّفتنا 40 استدعاء API مباشر عبر Qwen3.8-Max وسابقيه في 2026-08-04، اليوم التالي لإطلاق علي بابا له. لم تكن المفاجأة 2.4 تريليون معامل. كانت هذه: يتقاضى 3.8-Max رسومًا أعلى بنسبة 35.6% لكل رمز مقارنة بـQwen3.7-Max، ومع ذلك جاء أرخص بنحو 4 أضعاف لكل إجابة، لأنه توقف عن الإفراط في التفكير. وثمة أمر آخر تخطئ فيه معظم تغطيات الإطلاق: إنه ليس مفتوح المصدر. ليس اليوم.
نُشر هذا المقال لأول مرة في 2026-07-19، حين كان Qwen3.8 نسخة معاينة دون مواصفات منشورة. أُعيدت كتابته في 2026-08-04 بناءً على الإصدار العام (GA) واختباراتنا الخاصة عبر API.
أهم الاستنتاجات
- حتى تاريخ 2026-08-04، لا يزال Qwen3.8-Max متاحًا عبر API فقط. وعدت علي بابا بإصدار الأوزان «الأسبوع المقبل»، أي أسبوع 2026-08-10، على Hugging Face وModelScope.
- قسنا $0.001592 لكل استدعاء قصير مقابل $0.006428 على Qwen3.7-Max، رغم ارتفاع السعر لكل رمز.
- نتائج علي بابا الخمس في الاختبارات المعيارية مُبلَّغ عنها من المورّد نفسه. لم نجد أي تقييم مستقل منشور حتى تاريخ 2026-08-04.
- إدخال الصور والفيديو حقيقي وجديد فعلاً. تحققنا من كليهما عبر الـAPI ومن رفض 3.7-Max لهما.
ما الذي تغيّر بين المعاينة والإصدار العام (GA)
أصبح Qwen3.8-Max متاحًا للجميع (GA) في 2026-08-03، وأجاب الإصدار عن كل سؤال مفتوح أدرجته هذه الصفحة قبل أسبوعين. مرحلة المعاينة أعطتنا عدد المعاملات ووعدًا فقط. أما إصدار GA فأضاف نافذة سياق مؤكدة بمليون رمز، وإدخال نص وصورة وفيديو معًا، وخمس نتائج اختبارات معيارية منشورة، وسعرًا لكل رمز.
إليك سجل المجاهيل القديم، بعد حسمها:
| ما قالته هذه الصفحة في 2026-07-19 | الحالة في 2026-08-04 |
|---|---|
| أي نتيجة اختبار معياري منشورة: لا شيء | خمس نتائج مُبلَّغ عنها من علي بابا، منشورة |
| المعاملات النشطة / إعدادات MoE: غير مُفصح عنها | يُتداول على نطاق واسع أنها نحو 95 مليار معامل نشط، MoE متناثر. التقارير متضاربة، انظر أدناه |
| نافذة السياق والحد الأقصى للمخرجات: غير معلنة | مليون رمز إدخالاً، 131,072 إخراجًا، مؤكدة عبر الـAPI المباشر |
| النمط: غير معلن | نص + صورة + فيديو إدخالاً، نص إخراجًا. تحققنا من ذلك بأنفسنا |
| تسعير كل رمز: غير مُفصّل | $2.00 لكل مليون إدخالاً، $6.00 لكل مليون إخراجًا |
| تاريخ إصدار الأوزان المفتوحة: «قريبًا»، دون تاريخ | «الأسبوع المقبل»، مع تسمية Hugging Face وModelScope |
| Qwen3.8-Max-Preview متاح الآن مباشرة | انتهت المعاينة. صدر إصدار GA |
بند واحد لم يُحسم. لا يزال توزيع المعاملات محل جدل. تنص مقالة إطلاق MarkTechPost بوضوح على أن عدد المعاملات النشطة لم تُفصح عنه علي بابا، في حين تنشر SiliconANGLE وThe Decoder وCoursiv جميعها رقم ~95 مليار معامل نشط. أعدنا قراءة مقالة MarkTechPost في 2026-08-04 وما زالت تقول غير مُفصح عنه. مصدر أحدهم مخطئ، والأمانة تقتضي أن نخبرك أن التغطية الصحفية لهذا الرقم بالتحديد تضاربت يوم الإطلاق.
لم نتمكن من التحقق من ذلك في أي من الاتجاهين. لا تكشف استجابة /models من OpenRouter عن أي حقل لعدد المعاملات على الإطلاق، لذا لا شيء في اختباراتنا يؤكد أو ينفي إجمالي 2.4 تريليون أو 95 مليار معامل نشط.
هل Qwen3.8-Max مفتوح المصدر؟ ليس في 4 أغسطس
لا. حتى تاريخ 2026-08-04، لا يزال Qwen3.8-Max متاحًا عبر API فقط. جدولت علي بابا إصدار الأوزان «الأسبوع المقبل» على Hugging Face وModelScope، ولم تُعلن عن أي ترخيص. تستمر التغطية الصحفية في خلط «المتاح» بـ«المفتوح»، وهذا الفارق هو جوهر القصة كلها. لا توجد أوزان يمكن تحميلها اليوم، مهما قال أي عنوان رئيسي.
تُختزل ثلاث حالات مختلفة في كلمة واحدة. وهي ليست الشيء نفسه:
| الحالة | Qwen3.8-Max في 2026-08-04 |
|---|---|
| متاح عبر API | نعم. عبر Alibaba Cloud Model Studio، إضافة إلى موزّعين وموجّهات (routers) |
| الأوزان قابلة للتحميل | لا. موعودة بـ«الأسبوع المقبل»، دون تاريخ محدد |
| شروط الترخيص | غير معلنة. لا يوجد أي نص ترخيص للاطلاع عليه |
تحققنا من أقوى دليل متاح بدلاً من الاكتفاء بتصريح أي جهة: بحث على Hugging Face عن Qwen3.8 في 2026-08-04 لا يُعيد أي بطاقة نموذج من علي بابا. ما يُعيده فعلاً هو أربعة رفعات مجتمعية باسم Qwen3.8_4B_Distilled ومتغيرات منه، وهي تقطيرات (distills) من جهات خارجية، وليست النموذج الرائد. إذا كنت تتصفح تلك الصفحة بسرعة، فمن السهل الخلط بينها وبين الإصدار الحقيقي.
ملاحظة بشأن الترخيص، لأن السابقة تُنشر باستمرار وكأنها التزام. صدر كل من Qwen 3.5 وQwen 3.6 بموجب ترخيص Apache 2.0. لكن ترخيصًا مجتمعيًا مقيّدًا عند 2.4 تريليون معامل قد يظل تقنيًا «أوزانًا مفتوحة» بينما يغيّر ما يُسمح لك ببنائه بها. وإلى أن يظهر نص الترخيص، فإن أي شخص يخبرك بما يمكنك فعله بهذه الأوزان إنما يخمّن. وهذا أيضًا سبب عدم إدراج Qwen3.8-Max في قائمتنا لنماذج اللغة مفتوحة المصدر التي تستحق التشغيل في 2026: فهو لا يستوفي الشرط بعد.
ما قسناه: أرخص بـ4 أضعاف لكل استدعاء رغم ارتفاع السعر بنسبة 35.6%
أجرينا 40 استدعاء مفوترًا مقابل qwen3.8-max وqwen3.7-max وqwen3-max عبر OpenRouter في 2026-08-04، بإجمالي إنفاق $1.4728. حُسبت كل تكلفة أدناه من كائن usage المُعاد، وتم التحقق منها مقابل الرقم المفوتر فعليًا من OpenRouter. تطابقت جميعها. النتيجة الرئيسية تسير عكس اتجاه تغيّر السعر.
لنبدأ بالسعر. التسعير المباشر من GET /models في 2026-08-04 يضع 3.8-Max عند $2.00 إدخالاً / $6.00 إخراجاً لكل مليون رمز مقابل 3.7-Max عند $1.475 / $4.425. هذا ارتفاع بنسبة 35.6% في كلا الجانبين، والنسبة متطابقة في الحالتين (2.000/1.475 = 6.000/4.425 = 1.3559). يمكنك التحقق من الأرقام الحالية على صفحة نموذج OpenRouter.
والآن الموجّه (prompt) البسيط نفسه أُرسل إلى النماذج الثلاثة، بثلاث تشغيلات لكل منها، temperature: 0، بثًا مباشرًا (streamed):
| النموذج | أول رمز (3 تشغيلات) | أول محتوى مرئي | زمن التنفيذ الكلي (3 تشغيلات) | رموز الإكمال | منها رموز التفكير (reasoning) | متوسط التكلفة/الاستدعاء |
|---|---|---|---|---|---|---|
| qwen3.8-max | 2.249s / 0.874s / 1.054s | 5.414s / 5.058s / 4.209s | 6.338s / 6.734s / 5.130s | 242 / 287 / 243 | 156 / 194 / 157 | $0.001592 |
| qwen3.7-max | 4.871s / 1.157s / 1.670s | أبدًا / 22.358s / 25.998s | 31.147s / 24.013s / 27.661s | 1502 / 1281 / 1443 | 1500 / 1174 / 1346 | $0.006428 |
| qwen3-max | 2.617s / 2.892s / 2.386s | 2.617s / 2.892s / 2.386s | 4.401s / 4.601s / 4.081s | 105 / 105 / 107 | 0 / 0 / 0 | $0.000431 |
عمودا الرمز الأول المنفصلان ضروريان لأن كلا نموذجي التفكير يبثّان تفكيرًا مخفيًا قبل أي نص للإجابة. على 3.8-Max يصل رمز في أقل من ثانية في تشغيلين من أصل ثلاثة، لكن أول كلمة يمكن للمستخدم قراءتها فعليًا تصل بعد أربع إلى خمس ثوانٍ. وفي التشغيل الأول على 3.7-Max لم تصل على الإطلاق. إذا كنت تبني واجهة بث مباشر (streaming UI) على نموذج تفكير، تظل أيقونة التحميل (spinner) تدور لفترة طويلة بعد أن يثبت أن الاتصال حي.
اقرأ عمود التفكير مرتين. في موجّه يطلب شرحًا من ثلاث جمل لمرشّح بلوم (Bloom filter)، أنفق 3.7-Max ما بين 1,174 و1,500 رمز تفكير. أنفق 3.8-Max ما بين 156 و194. هذا يعني تفكيرًا أقل بنحو 7 أضعاف للإجابة نفسها، ورموز التفكير تُفوتر بسعر رموز الإخراج. النتيجة: 3.8-Max أرخص بنحو 4 أضعاف لكل استدعاء، وأسرع بمقدار 4 إلى 5 مرات من حيث زمن التنفيذ الكلي من جهازنا، بما في ذلك زمن ذهاب وإياب الشبكة، رغم أنه يكلّف 35.6% أكثر لكل رمز. ارتفع السعر المُعلن وانخفضت الفاتورة.
وينعكس هذا كلما كبرت الموجّهات. بحساب نظري من التسعير المباشر وليس بالقياس الفعلي، فإن استدعاءً بـ30,000 رمز إدخال و500 رمز إخراج يكلّف $63.00 لكل ألف استدعاء على 3.8-Max مقابل $46.46 على 3.7-Max. وعند 100,000 رمز إدخال يصبح $203.00 مقابل $149.71. فبمجرد أن تصبح معظم رموزك إدخالاً، تتوقف ميزة كفاءة التفكير عن تعويض ارتفاع السعر، ويصبح 3.8-Max الأغلى بين الثلاثة. فأي نموذج هو الأرخص يعتمد فعليًا على نسبة الإدخال إلى الإخراج لديك، وهو نفس الدرس الذي يخلص إليه دومًا مقارنة أسعار API لنماذج اللغة لدينا.
reasoning_effort جديد، وQwen3.7-Max يتجاهله بصمت
تظهر reasoning_effort ضمن المعاملات المدعومة في 3.8-Max، وليس في 3.7-Max. على 3.8-Max تُحدث فرقًا متواضعًا: عبر ثلاث تشغيلات لكل قيمة، أنتجت minimal رموز تفكير بلغت 67 و108 و124 مقابل high عند 163 و136 و173. أي متوسط 108 مقابل 163، على الموجّه نفسه، عند temperature: 0.
النتيجة التي تكلّف مالاً موجودة في النموذج الأقدم. إرسال reasoning_effort: "low" إلى 3.7-Max يُقبل بدلاً من أن يُرفض، ثم يُتجاهل: ذلك الاستدعاء استهلك 1,401 رمز تفكير رغم ذلك، وفوتر بنفس $0.006689 مثل الاستدعاء المطابق الشكل الذي سجّلناه. لا خطأ، لا تحذير، لا أثر. إذا كنت تضبط التكلفة عبر خفض جهد التفكير، تحقق من أن ذلك يُحدث فعلاً فرقًا على النموذج الذي تستدعيه فعليًا، لأن معامِلاً غير مدعوم هنا يفشل بصمت لا بصخب.
فخّ الاستجابة الفارغة الذي يجب فحصه قبل الترحيل
استخدم أول تشغيل اختباري لدينا max_tokens: 400 وتسبب في تعطّل السكربت الخاص بنا. تبيّن أن السبب أهم من الاختبار نفسه. يمكن لـQwen3.7-Max إنفاق كامل ميزانية الرموز على التفكير وإعادة سلسلة فارغة، مع finish_reason: "length"، وفوترة كاملة.
واجهنا هذا ثلاث مرات منفصلة. عند max_tokens: 400: 402 رمز إكمال، 400 منها تفكير، صفر حرف إجابة، وفوترة $0.001822. عند max_tokens: 1500: 1,502 رمز، 1,500 منها تفكير، صفر حرف، $0.006689 مقابل لا شيء. ومرة أخرى في استدعاء لاحق، $0.006735. لا خطأ، لا استثناء، مجرد كائن استجابة يبدو سليمًا بسلسلة محتوى فارغة.
إذا كنت تُرحّل تكاملاً قائمًا مع 3.7-Max ويضبط الكود لديك قيمة متواضعة لـmax_tokens، خصص وقتًا لاختبار هذا المسار. تفكير 3.8-Max الأقصر بكثير يجعله أقل عرضة لذلك بشكل ملموس. لكنه ليس محصنًا تمامًا.
عبء رموز صغير لا يذكره أحد
احتُسب الموجّه نفسه المكوّن من 12 كلمة بـ67 رمز موجّه على 3.8-Max و29 على 3.7-Max، بثبات عبر كل تشغيل (27 على qwen3-max). أي نحو 38 رمزًا من العبء الثابت، ربما بسبب قالب نظام أو محادثة أكبر. في استدعاء RAG بـ100,000 رمز، يتلاشى هذا الفرق تقريبًا. أما في مصنّف (classifier) عالي الحجم يطلق موجّهات قصيرة، فإنه يضاعف فاتورة الإدخال لديك أكثر من مرتين قبل أن تكتب كلمة واحدة.
هل يقبل Qwen3.8-Max الصور والفيديو فعلاً؟
نعم، والإدخال متعدد الوسائط جديد فعلاً في هذا الجيل، وليس مجرد إعادة تسمية. يُعلن الـAPI عن text+image+video->text لـ3.8-Max، ونص فقط لـ3.7-Max. تحققنا من الفارق بإرسال الصورة نفسها إلى كليهما، ورفضها النموذج الأقدم عند طبقة التوجيه (routing).
أنشأنا صورة الاختبار محليًا بمُرمِّز PNG مكتوب يدويًا حتى تكون الحقيقة الأساسية معروفة من بنية الصورة نفسها: 750×270 بكسل، أرقام كتلية سوداء 4739 على خلفية بيضاء، مع شريط أفقي أحمر عبر الأعلى. أُرسلت مُرمَّزة بـbase64، وأعاد qwen3.8-max DIGITS: 4739 وTOPBAR: red. صحيحة في كلا المعيارين، خلال 6.99s، بتكلفة $0.002146. أما الطلب نفسه إلى qwen3.7-max فعاد بـHTTP 404 {"error":{"message":"No endpoints found that support image input"}}.
الفيديو يعمل أيضًا، مع تحفّظ كدنا نسجّله كإخفاق. اثنان من عناوين MP4 العامة الثلاثة التي جرّبناها أعادا HTTP 400 "Failed to download multimodal content". هذا إخفاق من علي بابا في جلب الملف، وليس رفضًا من المسار للفيديو. ومع عنوان تمكّن من جلبه، وصف 3.8-Max مقطع Big Buck Bunny بدقة، بما في ذلك تسمية الشخصية، خلال 24.24s بتكلفة $0.006528.
ملاحظتان عمليتان قبل أن تبني على هذا. فُوتر الفيديو كـ696 رمز موجّه عادي لمقطع مدته نحو 10 ثوانٍ، وأعاد usage.prompt_tokens_details.video_tokens القيمة 0، لذا لا يمكنك فصل تكلفة الفيديو من ذلك الحقل. كما أن جزء محتوى مُشوَّه الصيغة يفشل بصمت: إرسال {"type": "video", "video": [url]} بدلاً من video_url أعاد HTTP 200 مع قول النموذج بأدب إنه لا يستطيع رؤية أي فيديو، مع فوترة رغم ذلك. استخدم video_url.
يستحق المعرفة: حين طلبنا من 3.8-Max وصف قدراته الخاصة، أجاب Input modalities: text. وهذا خطأ، كما أثبت الاختبار التالي في تشغيلنا نفسه. وصف النموذج لنفسه هو مُخرج نموذج لغوي، وليس ورقة مواصفات.
كيف يصمد سياق المليون رمز عمليًا؟
زرعنا ثلاث حقائق فريدة عند عمق 10% و50% و90% ضمن نص حشو مُولَّد، وطلبنا الحقائق الثلاث في استدعاء واحد. عادت 18 من أصل 18 «إبرة» صحيحة عبر ست تشغيلات على نموذجين، عند أحجام موجّهات تتراوح من 5,723 إلى 247,911 رمزًا، وقُيِّمت بمطابقة نصية دقيقة (substring) في الكود لا بقراءة الإجابات.
تشغيلاتنا على qwen3.8-max (كما أن تشغيلَي qwen3.7-max عند 83,380 و247,873 رمزًا، وتشغيل qwen3-max واحد عند 78,255، أعادت أيضًا كل إبرة):
| رموز الموجّه (qwen3.8-max) | زمن الاستجابة | التكلفة | الإبر المكتشَفة |
|---|---|---|---|
| 5,723 | 9.24s | $0.01409 | 3 من 3 |
| 25,703 | 13.43s | $0.05453 | 3 من 3 |
| 83,418 | 17.63s | $0.16965 | 3 من 3 |
| 247,911 | 38.54s | $0.49828 | 3 من 3 |
يتوسّع زمن الاستجابة بشكل دون خطي، وهذا هو الجزء المفيد عمليًا: 43 ضعفًا من رموز الإدخال يكلّف 4.2 ضعف فقط من زمن التنفيذ.
والآن الحدود الصادقة، لأن هذا هو الطرف السهل من تقييم السياق الطويل. استرجاع حقيقة مزروعة حرفيًا لا يقول الكثير عن التفكير عبر مستند كبير، واختبرنا كل حجم مرة واحدة فقط. لم نُجرِ استدعاءً بمليون رمز. فبسعر $2.00 لكل مليون رمز إدخال، كان استدعاء واحد سيكلّف نحو $2.00، أي أكثر من كامل تشغيل هذا الاختبار، وعيّنة واحدة لن تخبرنا الكثير. لذا فإن سقف المليون رمز المُعلن عنه غير مُتحقَّق منه من طرفنا. كما أن 3.7-Max تطابق تمامًا مع 3.8-Max عند كلا الحجمين اللذين قارناهما، لذا فإن استرجاع السياق الطويل ليس هو النقطة التي يتميز فيها هذا الجيل.
ظهر هنا فخّ تسعير تُخطئه تغطية الإطلاق بالكامل. يحمل qwen3-max تجاوزات تسعير متدرجة (tiered) تضاعف سعره فوق 32,000 رمز موجّه وترفعه مجددًا فوق 128,000، بينما 3.8-Max و3.7-Max بسعر ثابت عند كل طول. أكّدنا هذا الفارق من الفوترة الفعلية: استدعاؤنا بـ78,255 رمزًا إلى qwen3-max فُوتر بـ$0.12227، أي بسعر $1.56/M، وليس السعر المُعلن $0.78/M. عند هذا الطول يكلّف تقريبًا ما يكلّفه 3.7-Max بالضبط ($0.12523). سعره المُعلن أقل من النصف. وسعره الحقيقي عند 80 ألف رمز يبعد بمقدار خطأ تقريب فقط.
نتائج علي بابا الخمس في الاختبارات المعيارية، ولماذا لم يُتحقَّق من أي منها
نشرت علي بابا خمس نتائج اختبارات معيارية مع إصدار GA. كل واحدة منها تأتي من تشغيلات علي بابا الداخلية الخاصة، ولم نجد أي تقييم مستقل منشور حتى تاريخ 2026-08-04. هذه الجملة تستحق أن تجاور الأرقام مباشرة، لا أن تأتي بعدها بثلاث فقرات.
| الاختبار المعياري | النتيجة المُبلَّغ عنها من علي بابا | هل تحقّقت منها جهة خارجية؟ |
|---|---|---|
| Terminal-Bench 2.1 | 86.6 | لا، حتى تاريخ 2026-08-04 |
| GPQA Diamond | 92.6 | لا، حتى تاريخ 2026-08-04 |
| PaperBench | 93.0 | لا، حتى تاريخ 2026-08-04 |
| OSWorld-Verified | 86.1 | لا، حتى تاريخ 2026-08-04 |
| DeepSWE 1.1 | 56.6 (النموذج السابق: 21.6) | لا، حتى تاريخ 2026-08-04 |
أبلغت علي بابا أيضًا عن مؤشر تجميعي داخلي بلغ 0.725، مرتفعًا من 0.474، ووضعت النموذج قريبًا من أو أعلى من Claude Opus 4.8 وFable 5 وGPT-5.6 Sol. كما تداولت تصنيفات ساحات المنافسة (arena): المركز الخامس في Text Arena والثاني في Vision Arena بحسب إعلان علي بابا نفسها في 2026-08-03، وهو ما لم نُعِد التحقق منه على لوحة الصدارة المباشرة. تتحرك ترتيبات الساحات يوميًا. تعامل مع أي ترتيب تقرأه هذا الأسبوع باعتباره لقطة زمنية مؤرَّخة.
ما لم يقسه أحد بعد، بمن فيهم نحن: الإنتاجية تحت التزامن، الأداء بغير الإنجليزية، تقييمات السلامة والمواءمة، وموثوقية استدعاء الأدوات (tool-calling). أرقامنا نحن تغطي زمن الاستجابة والتكلفة والنمط واسترجاع السياق الطويل على مسار واحد فقط، ولا شيء غير ذلك. تقرير إطلاق Bloomberg كرر ادعاءات الاختبارات المعيارية دون اختبار مستقل، وهو ما تقف عنده تقريبًا كل التغطيات الصحفية حاليًا.
بالنسبة للأرقام التي تم التحقق منها، فإن مقارنة Qwen مقابل DeepSeek مقابل GLM لدينا هي المرجع الأفضل، وKimi K3 بحجم نحو 2.8 تريليون هو المنافس من حيث الحجم الذي يقارن الجميع هذا النموذج به.
Qwen3.8 مقابل Qwen3-8B، والانعطافة نحو الأوزان المفتوحة خلف هذا الإصدار
Qwen3.8 هو النموذج الرائد من علي بابا بـ2.4 تريليون معامل. أما Qwen3-8B فهو نموذج كثيف بـ8 مليارات معامل من سلسلة Qwen3، متاح للتحميل منذ عام 2025. اسمان متشابهان في الشكل، لكن الفارق في الحجم يبلغ نحو 300 ضعف. لا تزال محركات البحث تخلط بينهما، وكذلك عدد مفاجئ من إجابات المنتديات.
تفاقمت مشكلة التسمية هذا الأسبوع، لا أن تحسّنت. الأشياء الوحيدة على Hugging Face التي تحمل اسم «Qwen3.8» حاليًا هي تقطيرات مجتمعية بحجم 4 مليارات. إذا بحثت عن الأوزان واستولت يدك على واحدة منها، فأنت تُحمِّل شيئًا لا علاقة له بالنموذج ذي الـ2.4 تريليون معامل.
نموذجان رائدان مغلقان، ثم هذا
وعد الأوزان المفتوحة هو الخبر الحقيقي هنا، ويُقرأ بشكل مختلف بمجرد أن تطّلع على تاريخ هذه العائلة من النماذج. أمضت علي بابا جيلين وهي تتبع انقسامًا متعمدًا: نماذج عمل مفتوحة الأوزان للجميع، ونموذج رائد مغلق في القمة.
| الجيل | الأوزان | ملاحظات |
|---|---|---|
| Qwen 3.5 (0.8B إلى 397B-A17B) | مفتوحة، Apache 2.0 | صدرت العائلة كاملة للعموم |
| Qwen 3.6 (27B كثيف، 35B-A3B خليط خبراء) | مفتوحة، Apache 2.0 | استمر النمط نفسه |
| Qwen3.7-Max | مغلقة | عبر API فقط. بلا GGUF، وبلا نقطة تفتيش على Hugging Face |
| Qwen3.8-Max | موعودة بأن تكون مفتوحة، لم تُشحن بعد | «الأسبوع المقبل» حتى تاريخ 2026-08-03. الترخيص غير معلن |
أغلقت علي بابا مستوى النموذج الرائد لجيلين متتاليين، وهي تقول الآن إنها ستفتح أكبر نموذج بنته على الإطلاق. إذا وصلت الأوزان كما وُعدت، فتلك انعطافة حقيقية تضع ضغطًا على كل مختبر يتعامل مع فكرة «المستوى الحدودي يبقى مغلقًا» كأمر مُسلَّم به. وإذا تأخرت، فسيصبح هذا ثالث إصدار Max مغلق على التوالي. كلا الاحتمالين قائم حتى تاريخ 2026-08-04. رأينا الديناميكية نفسها تتكرر مع GLM 5.2، حيث كان الترخيص الفعلي المشحون أهم من الإعلان نفسه.
هل يمكنك تشغيل Qwen3.8-Max بنفسك؟ (لا تزال الإجابة: لا)
لا، ومواصفات إصدار GA تجعل ذلك أكثر وضوحًا لا أقل. بإجمالي 2.4 تريليون معامل، هذا ليس نموذجًا تُشغّله على بنيتك التحتية الخاصة، حتى بعد صدور الأوزان. حتى DeepSeek-V3.2 بـ685 مليار معامل يصفه من قاموا بذلك فعلاً بأنه مشروع بنية تحتية جادّ. وهذا النموذج أكبر من ذلك بعدة أضعاف.
فماذا يمنحك فعليًا نموذج بـ2.4 تريليون معامل مفتوح الأوزان؟
- يمكن لمزوّدي خدمات الاستدلال (inference) استضافته، وهو ما يعني منافسة في الأسعار، وبالتالي انخفاض تكلفة كل رمز بالنسبة لك
- تصبح عمليات النشر السيادية والمنظّمة والمعزولة عن الشبكة (air-gapped) ممكنة عند هذا المستوى لأول مرة
- يحصل الباحثون والقائمون بالضبط الدقيق (fine-tuning) على نموذج أساسي بحجم حدودي للعمل عليه
- هذا لا يعني أنه سيعمل على جهازك، أو على وحدة A100 واحدة لديك، أو ضمن ميزانية وحدات GPU لشركتك الناشئة
إذا أردت الحساب الدقيق لما يتطلبه فعليًا تشغيل نماذج كبيرة مفتوحة الأوزان، فإن دليل متطلبات VRAM لنماذج اللغة لدينا يقدّم ذلك الحساب بدقة. النسخة المختصرة لهذا النموذج: لا تفعل.
هل ينبغي أن تنتقل، أو تختبر، أو تنتظر؟
| وضعك الحالي | ما كنا سنفعله في 2026-08-04 |
|---|---|
| تُشغّل Qwen3.7-Max في بيئة الإنتاج | اختبر 3.8-Max أولاً على حركة الموجّهات القصيرة. هذا هو المكان الذي ظهرت فيه فجوة التكلفة بمقدار 4 أضعاف لدينا. ثم افحص معالجة max_tokens لديك لحالة الاستجابة الفارغة |
| عبء عمل سياق طويل أو RAG مكثف | ابقَ كما أنت الآن. يكلّف 3.8-Max 35.6% أكثر لكل رمز، وتطابق تمامًا مع 3.7-Max في اختبار الاسترجاع لدينا |
| تحتاج إلى إدخال صور أو فيديو | هذا هو سبب الانتقال. لا يستطيع 3.7-Max قبول صورة على الإطلاق، وأكّدنا خطأ الـ404 |
| تنتظر الأوزان المفتوحة | دوّن تاريخ 2026-08-10 في تقويمك. لا شيء تفعله إلى أن تظهر بطاقة نموذج وترخيص للاطلاع عليه |
| راضٍ عن Claude أو GPT | لا شيء يتغير اليوم. نتائج علي بابا في الاختبارات المعيارية غير موثَّقة، والأرقام غير الموثَّقة ليست مبررًا للترحيل |
المنهجية أهم من الحكم النهائي. كل نموذج اختبرناه فعليًا في بيئة الإنتاج تصرّف بشكل مختلف عن موقعه في لوحة الصدارة، لأن موجّهاتك، وقاعدة الكود الخاصة بك، وتحمّلك لإعادة المحاولات ليست موجودة في أي اختبار معياري. مهمّتان برمجيتان في تشغيلنا توضحان الفكرة: سجّل كل من 3.8-Max و3.7-Max 11 من 11 في مهمة اقتطاع عرض السلسلة النصية، ونجحا معًا في 5,000 من 5,000 حالة عشوائية (fuzzed) في حساب التواريخ. من حيث الصحة، لم نتمكن من التمييز بينهما. الفجوة التي قسناها تكمن في زمن الاستجابة وإنفاق الرموز على الموجّهات السهلة، لا في القدرة على الموجّهات الصعبة.
تُقيّم عملية ترحيل وتريد رأيًا إضافيًا حول نموذج التكلفة؟ دع فريقنا يختبره تحت الضغط على عبء عملك ←.
جميع الأرقام تم التحقق منها في 2026-08-04. يتغير التسعير وترتيبات الساحات والجدول الزمني للأوزان بشكل متكرر. تأتي قياساتنا من مسار واحد (OpenRouter إلى علي بابا)، وجهاز واحد، ويوم واحد، بـn=3 لزمن الاستجابة وn=1 لمعظم الفحوصات الوظيفية.
الأسئلة الشائعة
هل Qwen3.8-Max مفتوح المصدر؟
ليس حتى تاريخ 2026-08-04. إنه متاح عبر API فقط. جدولت علي بابا إصدار الأوزان «الأسبوع المقبل» على Hugging Face وModelScope، ولم تُعلن عن أي ترخيص. العناوين الرئيسية التي تصفه بأنه مفتوح المصدر تسبق الحقائق. بحث على Hugging Face يُعيد فقط تقطيرات من جهات خارجية بحجم 4 مليارات، وليس بطاقة نموذج من علي بابا.
كم تكلفة Qwen3.8-Max؟
$2.00 لكل مليون رمز إدخال و$6.00 لكل مليون إخراج، مع سعر مُبلَّغ عنه للإدخال المخزَّن مؤقتًا عند $0.25. هذا أعلى بنسبة 35.6% من Qwen3.7-Max في كلا الجانبين. قسنا متوسطًا قدره $0.001592 لكل استدعاء قصير، أي أرخص بنحو 4 أضعاف من 3.7-Max على الموجّه نفسه، لأنه يصدر رموز تفكير أقل بكثير.
كم عدد معاملات Qwen3.8-Max؟
2.4 تريليون معامل إجمالاً، بحسب إعلان علي بابا وكل جهة تغطي الخبر. عدد المعاملات النشطة محل جدل: تُبلّغ SiliconANGLE وThe Decoder وCoursiv عن نحو 95 مليار معامل نشط، بينما تذكر MarkTechPost أن علي بابا لم تُفصح عن ذلك. لا يكشف الـAPI عن أي حقل للمعاملات، لذا لم نتمكن من التحقق من أي من الرقمين.
ما نافذة السياق الخاصة بـQwen3.8-Max؟
يُعلن الـAPI المباشر عن 1,000,000 رمز سياق و131,072 رمزًا كحد أقصى للإكمال. اختبرنا الاسترجاع حتى 247,911 رمزًا دون أي إخفاقات. لم نُجرِ استدعاءً بمليون رمز، لأن ذلك كان سيكلّف نحو $2.00 ويتجاوز ميزانية اختبارنا، لذا فإن أعلى تلك النافذة غير مُتحقَّق منه من طرفنا.
هل يدعم Qwen3.8-Max إدخال الصور والفيديو؟
نعم لكليهما، وتحققنا منهما فعليًا. قرأ الأرقام واللون بشكل صحيح من صورة PNG مُولَّدة محليًا، ووصف فيديو بدقة عند تزويده بعنوان تمكنت علي بابا من جلبه. يرفض Qwen3.7-Max الصور تمامًا برمز خطأ 404. فشل اثنان من عناوين الفيديو الثلاثة لدينا في خطوة تحميل المزوّد.
هل نتائج Qwen3.8-Max في الاختبارات المعيارية موثَّقة بشكل مستقل؟
لا. Terminal-Bench 2.1 عند 86.6، وGPQA Diamond عند 92.6، وPaperBench عند 93.0، وOSWorld-Verified عند 86.1، وDeepSWE 1.1 عند 56.6 — جميعها من تشغيلات علي بابا الداخلية. حتى تاريخ 2026-08-04 لم نجد أي تقييم من جهة خارجية منشورًا لأي منها.
هل يمكنني تشغيل Qwen3.8-Max محليًا؟
واقعيًا لا، حتى بعد شحن الأوزان. عند 2.4 تريليون معامل، هو أكبر بعدة أضعاف من DeepSeek-V3.2، الذي يُعد أصلاً مشروع بنية تحتية حقيقيًا للاستضافة الذاتية. توقّع أن تستهلكه عبر مزوّدي خدمات الاستدلال بدلاً من وحدات GPU الخاصة بك، ما لم تكن تُشغّل مركز بيانات.
هل ينبغي أن أُرحّل من Qwen3.7-Max إلى Qwen3.8-Max؟
يعتمد ذلك على مزيج الرموز لديك. على الموجّهات القصيرة، قسنا 3.8-Max بنحو ربع التكلفة وبسرعة أعلى بأربع إلى خمس مرات. أما في أعباء العمل ذات الإدخال الطويل فيكلّف 35.6% أكثر ويؤدي بنفس المستوى تمامًا في اختبار الاسترجاع لدينا. إذا كنت بحاجة إلى إدخال صور أو فيديو، فإن 3.7-Max لا يستطيع ذلك على الإطلاق.
متى ستصدر أوزان Qwen3.8-Max المفتوحة؟
قالت علي بابا «الأسبوع المقبل» في إعلانها بتاريخ 2026-08-03، مسمّية Hugging Face وModelScope كوجهتين. لا يوجد تاريخ محدد، ولا نص ترخيص. يُقال إن نموذجًا مرافقًا مفتوح الأوزان، Qwen3.8-27B، سيصدر إلى جانبها. نخطط لإعادة التحقق في 2026-08-10.