ai-machine-learning

مراجعة Kimi K3: نموذج Moonshot المفتوح 2.8T مقابل Fable 5 وGPT-5.6 Sol

بقلم Mert Batur
Jul 17, 2026
15 قراءة
مراجعة Kimi K3: نموذج Moonshot المفتوح 2.8T مقابل Fable 5 وGPT-5.6 Sol

مراجعة Kimi K3: نموذج Moonshot المفتوح 2.8T مقابل Fable 5 وGPT-5.6 Sol

آخر تحقق: 17 يوليو 2026. أُعيد التحقق من كل مواصفة وسعر ومعيار أدناه مقابل وثائق منصة Moonshot، وArtificial Analysis، والتغطية المستقلة يوم نشر هذا المقال. أُطلق Kimi K3 في 16 يوليو 2026.

في مراجعة Kimi K3 هذه، رقم واحد من الإطلاق يكفي لسرد القصة: تصدّر نموذج Moonshot الجديد لوحة Frontend Code Arena من المركز الأول، بقفزة قدرها 17 مرتبة مقارنة بـKimi K2.6، متجاوزاً حتى Claude Fable 5. هذا يعني أن نموذجاً صينياً مفتوح الأوزان فاز في مسابقة برمجة واجهات أمامية يحكّمها مطوّرون حقيقيون في مباريات عمياء. تحت الغطاء، إنه تصميم Mixture-of-Experts بـ2.8 تريليون معامل يُفعّل 16 خبيراً فقط من أصل 896 لكل رمز، ويقرأ مليون رمز من السياق، ويُسعّر الإدخال بين $0.30 و$3.00 لكل مليون. أما الفخ الذي يجب أن تعرفه قبل أن تتحمّس كثيراً: لا يمكنك تنزيل الأوزان بعد، وتقول Moonshot إن ذلك سيتغيّر في 27 يوليو.

الحكم السريع:

  • ما هو: الرائد من Moonshot AI، نموذج MoE بـ2.8T معامل وسياق 1M، مع إدخال صوري ومرئي أصلي واستدلال مُفعّل دائماً. معرّف API هو kimi-k3.
  • أين يفوز: في التصفح الوكيلي (BrowseComp بدرجة 91.2) والبرمجة طويلة المدى (SWE Marathon بدرجة 42.0، متفوقاً على كل من Fable 5 وGPT-5.6 Sol). المركز الأول في Frontend Code Arena التابعة لـArena.
  • أين يتأخر: في FrontierSWE وHLE-Full (يتصدّرهما Fable 5)، وDeepSWE (يتصدّره GPT-5.6 Sol). يضعه Artificial Analysis المستقل في المرتبة #4 من أصل 189 نموذجاً إجمالاً.
  • كم يكلّف: $0.30 عند إصابة الذاكرة المؤقتة / $3.00 للإدخال الجديد، و$15.00 للإخراج لكل مليون رمز. أغلى نموذج يُطلقه أي مختبر صيني حتى الآن.
  • الفخ: مفتوح الأوزان بالاسم فقط، إذ لن تُنشر نقطة التفتيش علناً حتى 27 يوليو 2026. وحتى ذلك الحين، لا استضافة ذاتية ولا تقييمات مستقلة من طرف ثالث.

إن أردت الإجابة في سطر واحد: Kimi K3 هو أول نموذج مفتوح الأوزان يتبادل ضربات حقيقية مع الطليعة المغلقة، لكنه برنامج يوم الإطلاق بإصدار أوزان معلّق وسعر مرتفع. تابع القراءة للاطلاع على المواصفات، وواقع المعايير (بما في ذلك تحفّظ يغيّر طريقة قراءتك لكل رقم)، وحساب التسعير، ومن يجب أن يشغّله فعلاً.

ما هو Kimi K3؟

Kimi K3 هو أحدث نموذج لغوي كبير من Moonshot AI، أُطلق في 16 يوليو 2026. إنه نموذج Mixture-of-Experts بإجمالي 2.8 تريليون معامل، يُفعّل 16 خبيراً فقط من أصل 896 خبيراً في كل رمز، بحيث تبقى تكلفة الحوسبة لكل رمز أقل بكثير مما يتطلّبه نموذج كثيف بحجم 2.8T. يقبل النموذج النص والصور والفيديو، ويحمل نافذة سياق بمليون رمز، ويُبقي الاستدلال مُفعّلاً افتراضياً.

إليك جدول المواصفات بنظرة سريعة.

المواصفةKimi K3
تاريخ الإطلاق16 يوليو 2026
المطوّرMoonshot AI
إجمالي المعاملات2.8 تريليون (Mixture-of-Experts)
النشط لكل رمز16 من أصل 896 خبيراً
الانتباه (Attention)Kimi Delta Attention (KDA)، بفك ترميز أسرع حتى 6.3x عند سياق 1M
نافذة السياق1,000,000 رمز
الوسائطإدخال نصي وصوري ومرئي (فيديو)
الاستدلالمُفعّل دائماً؛ مستوى واحد فقط "max" عند الإطلاق
معرّف نموذج APIkimi-k3 (متوافق مع OpenAI-SDK)
الأوزانمفتوحة الأوزان؛ الإصدار العام موعود في 27 يوليو 2026
السعر لكل مليون رمز$0.30 عند إصابة الذاكرة المؤقتة أو $3.00 للإدخال الجديد، $15.00 للإخراج

القصة الهندسية الأكثر إثارة هي تصميم الانتباه. تُسمّيه Moonshot بـKimi Delta Attention، أو KDA، وهو آلية انتباه خطّية هجينة تقول الشركة إنها توفّر فك ترميز أسرع حتى 6.3x في سياقات المليون رمز. يقرن K3 هذا التصميم بحزمة حيل أحدث يُسمّيها المختبر Attention Residuals وGated MLA وStable LatentMoE. لست بحاجة لحفظ هذه الاختصارات. خلاصتها أنها تنتج نموذجاً يبقى سريعاً بينما يحمل سياقاً هائلاً، وهو تحديداً عبء العمل الذي يُعطّل المعماريات الأقدم.

ضَع K3 إلى جانب النموذج الذي يحلّ محلّه، وستجد القفزة كبيرة. فهو يضاعف تقريباً ثلاث مرات عدد معاملات Kimi K2 (2.8T مقابل نحو 1T)، ويُضاعف أربع مرات نافذة سياق سلسلة K2.6 وK2.7 (1M مقابل 256K)، ويضيف إدخال الصور والفيديو إلى عائلة كانت تعتمد على النص أولاً. إذا جرّبت إصداراً سابقاً من Kimi ولم يُعجبك، فهذا نموذج مختلف تماماً.

معايير Kimi K3: أين يفوز وأين لا يفوز؟

معايير إطلاق Kimi K3 قوية فعلاً، ومختلطة فعلاً في آن واحد. فهو يتصدّر الميدان في بعض مهام البرمجة والوكلاء، ويتأخر بوضوح عن الطليعة المغلقة في مهام أخرى. قبل الجدول، تحفّظ واحد يهم أكثر من أي درجة منفردة: شغّلت Moonshot كل نموذج داخل بيئة البرمجة الخاصة به. جرى تسجيل درجات K3 في KimiCode، وFable 5 في Claude Code، وGPT-5.6 Sol في Codex. البرنامج المُحيط بالنموذج يؤثّر في نتائجه، لذا اقرأ هذه الأرقام باعتبارها اتجاهية لا لوحة صدارة نهائية.

إليك الأرقام الرئيسية للبرمجة والوكلاء من جدول إطلاق Moonshot.

المعيارKimi K3GPT-5.6 SolClaude Fable 5
Program Bench77.877.676.8
SWE Marathon42.039.035.0
Terminal-Bench 2.188.388.884.6
DeepSWE67.573.070.0
FrontierSWE81.271.386.6
BrowseComp91.2غير منشورغير منشور
OmniDocBench91.1غير منشورغير منشور

اقرأ الصفوف تباعاً، وسيظهر نمط واضح. K3 يفوز في العمل الطويل والشاق. في SWE Marathon، الذي يقيس جلسات هندسية مستمرة لساعات متعددة، تتفوّق درجة K3 البالغة 42.0 على كل من GPT-5.6 Sol وFable 5 بفارق واضح. يتقدّم أيضاً على الميدان في Program Bench، ويتصدّر في جانب الوكلاء كذلك، محقّقاً 91.2 في BrowseComp و91.1 في OmniDocBench، حيث تُبلّغ Moonshot أيضاً عن المركز الأول في Automation Bench.

أين يخسر؟ في DeepSWE، يتقدّم GPT-5.6 Sol بدرجة 73.0. وفي FrontierSWE، يتفوّق Fable 5 بوضوح عند 86.6، رغم أنه يستحق الإشارة إلى أن درجة K3 البالغة 81.2 لا تزال تتفوّق على درجة Sol البالغة 71.3 هناك. يعترف جدول Moonshot نفسه بأن K3 يتأخر عن Fable 5 في FrontierSWE وHLE-Full، ويتأخر عن GPT-5.6 Sol في DeepSWE. هذا ليس نموذجاً يتفوّق على الطليعة في كل مكان. إنه نموذج يتفوّق عليها في مكان ما، وهو أمر لم يحققه أي إصدار مفتوح الأوزان من قبل فعلياً.

القراءة المستقلة تؤكّد ذلك. يمنح Artificial Analysis درجة 57 لـK3 على مؤشره للذكاء، ويضعه في المرتبة #4 من أصل 189 نموذجاً، خلف Claude Fable 5 وإعدادَي استدلال لـGPT-5.6 Sol، لكن أمام Claude Opus 4.8. سرعة إخراجه المقيسة متواضعة نسبياً عند 62 رمزاً في الثانية. أما على صعيد تفضيل البشر، فإن حلول K3 في المركز الأول في Frontend Code Arena التابعة لـArena هو الأبرز، لأن هذا الترتيب يأتي من تصويت مطوّرين حقيقيين على مخرجات واجهة أمامية فعلية، لا من درجة مُبلَّغ عنها ذاتياً.

المطوّر المستقل Simon Willison شغّل K3 عبر اختباره الشهير لرسم بجعة على دراجة بصيغة SVG يوم الإطلاق. أنتج النموذج نتيجة جيدة، وكتب نص alt دقيقاً لصورته الخاصة، وهو ما يعكس جودة رؤيته البصرية. كما أشار إلى مفاجأة التكلفة التي سنتناولها في قسم التسعير، وذكّر القرّاء بأن اختبار SVG سريعاً لا يخبرك بشيء عن الاستدعاء الوكيلي للأدوات، وهو حيث يُثبت نموذج كهذا جدارته فعلياً. تحفّظ منصف.

Kimi K3 مقابل Fable 5 وGPT-5.6 Sol وDeepSeek وQwen

فأين يقف K3 في الميدان الأوسع؟ مقارنتان تهمّان هنا: مقابل الطليعة المغلقة، ومقابل زملائه من النماذج الصينية مفتوحة الأوزان.

مقابل الطليعة، التأطير الصادق هو "قريب من الطليعة، لا متصدّراً لها". لا يزال Claude Fable 5 وGPT-5.6 Sol يتصدّران تصنيفات الذكاء الإجمالية، ويحتفظ Fable 5 بتفوّق حقيقي في أصعب اختبارات الاستدلال والبرمجة الطليعية. ما تغيّر مع K3 هو أن الفجوة تقلّصت إلى مبادلات على مستوى معيار واحد بدلاً من هوّة فئوية كاملة. أن يتصدّر نموذج قابل للتنزيل SWE Marathon ويتصدّر تصويتاً أعمى للبرمجة الأمامية، فهذا ميدان جديد تماماً.

مقابل نظرائه مفتوحي الأوزان، K3 هو المستوى القياسي الجديد للقدرة الخام، لكنه ليس الخيار الافتراضي الواضح لكل مهمة. إذا كنت تزن الخيارات الصينية مفتوحة الأوزان كمجموعة، فإن مقارنتنا بين Qwen وDeepSeek وGLM تشرح كيف تقسّم هذه العائلات الثلاث السوق: Qwen لأخف بصمة استضافة ذاتية وأكثر الرخص تساهلاً، وDeepSeek لأرخص الرموز، وGLM للبرمجة العملية المباشرة. يقف K3 الآن فوقها جميعاً في المعايير القصوى، وفوقها في السعر أيضاً. إنه الخيار المتميّز في فئة بنت سمعتها على الرخص.

لميدان أوسع يشمل النماذج التي تتفوّق فعلاً على جودة فئة GPT-4، فإن مقارنتنا الشاملة لأفضل نماذج LLM مفتوحة المصدر لعام 2026 تضع ادّعاءات K3 في سياقها. النسخة المختصرة: K3 يرفع السقف بالنسبة للأوزان المفتوحة، لكن "الأوزان المفتوحة" و"الرخص" لم يعودا رسمياً الشيء نفسه.

أسعار Kimi K3 وحساب إصابة الذاكرة المؤقتة

هنا يصبح K3 مثيراً للجدل. تُسعّر Moonshot النموذج بـ$0.30 لكل مليون رمز إدخال عند إصابة الذاكرة المؤقتة، و$3.00 لكل مليون رمز إدخال جديد، و$15.00 لكل مليون رمز إخراج، بسعر ثابت عبر كامل نافذة المليون رمز.

قارنه بالنموذج الذي يحلّ محلّه، وستجد التحوّل صارخاً.

نوع الرمزKimi K3Kimi K2.6
الإدخال، جديد$3.00 / M$0.95 / M
الإدخال، إصابة الذاكرة المؤقتة$0.30 / Mغير معلن
الإخراج$15.00 / M$4.00 / M

هذه قفزة بنحو 3x في الإدخال ونحو 4x في الإخراج مقارنة بـK2.6. لاحظ Willison أن سعر $3/$15 يقع في الفئة نفسها التي يقع فيها Claude Sonnet. ووصف The Decoder نموذج K3 بأنه إشارة إلى أن عصر الذكاء الاصطناعي الصيني الرخيص جداً يقترب من نهايته. إذا كان سبب اعتمادك على نموذج صيني هو السعر فقط، فإن K3 سيجعلك تعيد التفكير مرتين.

لكن معدّل إصابة الذاكرة المؤقتة هو الرقم الذي يحدّد فاتورتك الحقيقية، فلنُجرِ الحساب على حلقة وكيلية واقعية، باستخدام الأسعار المنشورة من Moonshot. لنفترض أن وكيل البرمجة لديك يقرأ سياق قاعدة كود بحجم 200,000 رمز ويكتب 8,000 رمز من الإخراج، ويكرّر ذلك 20 مرة في اليوم:

  • تفويت الذاكرة المؤقتة (أول قراءة باردة): 200,000 رمز إدخال بسعر $3.00/M يساوي $0.60، بالإضافة إلى 8,000 رمز إخراج بسعر $15.00/M يساوي $0.12. أي نحو $0.72 لكل استدعاء، أو $14.40 يومياً.
  • إصابة الذاكرة المؤقتة (سياق متكرر، الحالة الشائعة في جلسة برمجة): 200,000 رمز إدخال بسعر $0.30/M يساوي $0.06، بالإضافة إلى نفس $0.12 للإخراج. أي نحو $0.18 لكل استدعاء، أو $3.60 يومياً.

اقتصاديات التخزين المؤقت تخفّض فاتورة الإدخال بنحو عشر مرات، من $0.60 إلى $0.06 لكل استدعاء. تُبلّغ Moonshot عن معدّل إصابة يتجاوز 90% في أعباء عمل البرمجة، وهذا هو السيناريو الذي يجعل K3 معقول التكلفة بدلاً من باهظ فعلاً. الدرس لميزانيتك: K3 مكلف في الاستدعاءات الباردة أحادية المرة، ومعقول داخل حلقة دافئة كثيفة السياق.

فخّ تكلفة إضافي كشفه Willison. يتيح K3 اليوم مستوى استدلال واحداً فقط هو "max"، وتُفوتَر رموز الاستدلال بسعر الإخراج. استهلك اختباره البسيط لصيغة SVG 13,241 رمز استدلال إضافة إلى 3,417 رمز إخراج، فكلّف موجّه بسيط نحو 25 سنتاً. لا يوجد بعد وضع "استدلال منخفض" رخيص، ما يعني أن K3 يدفع أكثر مما ينبغي على الأسئلة السهلة. إذا كانت السيطرة على التكلفة أولويتك، فإن دليلَينا حول أسعار LLM API وكيفية خفض تكاليف LLM API ينطبقان هنا مباشرة: خزّن مؤقتاً بقوة، ووجّه الاستدعاءات البسيطة إلى نموذج أرخص، واحتفظ بـK3 للعمل الصعب طويل السياق حيث يستحق سعره المرتفع.

الأوزان المفتوحة: ماذا تعني كلمة "مفتوح" هنا فعلياً؟

هذا هو الجزء الذي تجاوزته عناوين الإطلاق بسرعة. أُعلن عن Kimi K3 كنموذج مفتوح الأوزان، ولدى Moonshot سجلّ حقيقي في إطلاق نقاط تفتيش قابلة للتنزيل. لكن حتى 17 يوليو 2026، أوزان K3 ليست علنية بعد. لا تزال منظمة Moonshot على Hugging Face تُدرِج نقاط تفتيش سلسلة K2 فقط. تقول الشركة إن الأوزان الكاملة ستصل في 27 يوليو 2026.

لماذا تهم هذه الفجوة؟ ثلاثة أسباب عملية:

  • لا استضافة ذاتية بعد. لا يمكنك تشغيل K3 على عتادك الخاص أو عنقود خاص حتى تُنشر الأوزان. بالنسبة للفرق ذات متطلبات إقامة البيانات أو العزل التام عن الشبكة، K3 متاح عبر API فقط في الوقت الحالي، وهذا يُبطل جزءاً كبيراً من سبب اختيارك نموذجاً مفتوحاً أصلاً. وعندما تصل الأوزان فعلاً، سيساعدك دليلانا حول أفضل أدوات تشغيل نماذج LLM محلياً وتشغيل نموذج LLM محلياً على البدء، رغم أن نموذجاً بحجم 2.8T معامل هو من فئة العناقيد الحاسوبية، لا فئة الحاسوب المحمول.
  • لا تقييمات مستقلة بعد. كل معيار رأيته لـK3 نفّذته الشركة نفسها، داخل بيئة Moonshot الخاصة. لا يمكن أن توجد أرقام جادة من طرف ثالث حول أشياء مثل HLE أو مهام خاصة بالوكلاء حتى تحصل مختبرات خارجية على الأوزان لاختبارها. تعامل مع جدول الإطلاق باعتباره ادّعاءً قوياً، لا نتيجة مُتحقَّقاً منها.
  • شروط الترخيص لا تزال قيد الاستقرار. استخدمت إصدارات Kimi السابقة رخصاً متساهلة، لكن تأكّد من رخصة K3 الدقيقة على بطاقة النموذج الرسمية عند نشر نقطة التفتيش، خصوصاً إذا كنت تخطط لنشر تجاري.

لا شيء من هذا يجعل K3 أقل إثارة للإعجاب. لكنه يعني أنه إذا كانت خطتك تعتمد على تنزيل النموذج وضبطه دقيقاً، فإن تقييمك الحقيقي يبدأ في 27 يوليو، لا في 16 يوليو.

كيف نقيّم Kimi K3 لعمل عملائنا

ملاحظة سريعة حول مصدر هذه المراجعة، وأين تتوقف حدودها. في Techsy، نربط نماذج LLM من أطراف ثالثة بخطوط أنابيب إنتاجية لعملاء B2B، عادة عبر نقاط نهاية متوافقة مع OpenAI-SDK حتى نتمكن من تبديل النماذج دون إعادة بناء البنية الأساسية. يتناسب K3 مع هذا المسار بسلاسة: فهو يعرض واجهة API متوافقة مع OpenAI بمعرّف نموذج kimi-k3، لذا فإن إدراجه في تكامل قائم لتجربته هو مجرد تغيير في الإعدادات، لا إعادة كتابة كاملة.

في كل مرة يصدر فيها نموذج جديد، نُشغّله عبر التقييم الثابت نفسه على مهام تمثّل عمل عملائنا الفعلي قبل أن نوصي بأي شيء. وهنا الحدّ الصادق لهذه المراجعة: لا ننشر درجتنا الخاصة لـK3 بعد. الأوزان لم تصدر، ومعايير الإطلاق نفّذتها الشركة نفسها داخل بيئة Moonshot، والرقم المنصف يحتاج إعداداً محايداً على مهام تشبه عمل العملاء الحقيقي، لا لوحة صدارة. اقتباس معيار من طرف أول لنموذج عمره يوم واحد وأوزانه معلّقة سيكون تحديداً النوع من الأرقام الذي نخبر عملاءنا بعدم الثقة به.

ما يمكننا تقييمه اليوم من واجهة API الحية هو الجزء الذي لا يحتاج لوحة صدارة: سطح التكامل، ونموذج التكلفة، وأنماط الفشل. حساب التسعير أعلاه هو حسابنا الخاص المبني على الأسعار المنشورة من Moonshot، وليس معياراً، وهو يخبرك بالفعل بالحقيقة التشغيلية: انضباط التخزين المؤقت هو الفارق بين أن يكون K3 معقول التكلفة أو مشكلة في الميزانية. إذا كنت تريد مساعدة في معرفة ما إذا كان نموذج مثل K3 ينتمي إلى حزمتك التقنية، فهذا بالضبط نوع التقييم الذي نقوم به في ممارسة Techsy لتكامل الذكاء الاصطناعي، ويمكنك حجز استشارة مجانية للتحدث في الأمر.

من يجب أن يستخدم Kimi K3 (ومن لا ينبغي له ذلك)

Kimi K3 مناسب جداً لمجموعة محددة من المهام، وغير مناسب لأخرى. طابقه مع عبء العمل الفعلي لديك.

اختر K3 إذا:

  • كنت تشغّل تصفحاً أو بحثاً وكيلياً. تصدّره في BrowseComp وAutomation Bench، إضافة إلى أفضل قراءة مستقلة لبحث الوكلاء، يجعله الخيار الأقدر مفتوح الأوزان لوكلاء استخدام الأدوات حالياً.
  • كنت تقوم ببرمجة طويلة المدى. SWE Marathon هو المعيار الذي يعكس جلسات هندسية تمتد لساعات متعددة، ويتصدّره K3. إذا كانت وكلاؤك تعمل عبر قواعد كود كبيرة في جلسات طويلة، فهذا هو ميدانه الطبيعي.
  • كنت تريد نموذجاً مفتوح الأوزان قريباً من الطليعة، ويمكنك انتظار الأوزان. إذا كان هدفك استضافة نموذج مفتوح من الطراز الأول ذاتياً في 27 يوليو، فإن K3 هو المرشّح الأقدر المتاح.

انتظر إذا:

  • كنت تحتاج الأوزان اليوم. حتى 27 يوليو، K3 متاح عبر API فقط. نموذج قابل للتنزيل بالفعل يخدمك بشكل أفضل هذا الأسبوع.
  • كنت تشغّل حركة مرور عالية الحجم وحسّاسة للتكلفة. بمستوى استدلال واحد مكلف وتسعير إخراج مرتفع، K3 يدفع أكثر من اللازم في الاستدعاءات البسيطة. Kimi K2.7-Code أو نموذج مفتوح أرخص يفوز في العمل الكبير الحجم.
  • كنت تتطلّب تقييمات مستقلة مُثبتة قبل التبنّي. أرقام الإطلاق نفّذتها الشركة نفسها. إذا كانت عمليتك تتطلّب تحقّقاً من طرف ثالث، أمهله بضعة أسابيع.

الأسئلة الشائعة

ما هو Kimi K3؟

Kimi K3 هو النموذج اللغوي الكبير الرائد من Moonshot AI، أُطلق في 16 يوليو 2026. إنه نموذج Mixture-of-Experts بـ2.8 تريليون معامل، يُفعّل 16 من أصل 896 خبيراً لكل رمز، ويدعم نافذة سياق بـ1M رمز، ويقبل إدخال النص والصور والفيديو مع استدلال مُفعّل دائماً.

هل Kimi K3 مفتوح المصدر؟

أُعلن عن Kimi K3 كنموذج مفتوح الأوزان، لكن الأوزان ليست علنية حتى 17 يوليو 2026. تقول Moonshot إن نقطة التفتيش الكاملة ستصدر في 27 يوليو 2026. وحتى ذلك الحين، هو متاح فقط عبر تطبيقات Kimi وواجهة API، لذا لا يمكنك استضافته ذاتياً بعد.

كيف يختلف Kimi K3 عن Kimi K2؟

يضاعف K3 تقريباً ثلاث مرات عدد معاملات K2 (2.8 تريليون مقابل نحو تريليون واحد)، ويُضاعف أربع مرات نافذة سياق سلسلة K2.6 وK2.7 (1M مقابل 256K رمز)، ويضيف إدخالاً أصلياً للصور والفيديو إلى عائلة كانت تركّز على النص سابقاً. كما يُدخل تصميم Kimi Delta Attention الجديد.

كم تبلغ تكلفة Kimi K3؟

تُسعّر Moonshot نموذج K3 بـ$0.30 لكل مليون رمز إدخال عند إصابة الذاكرة المؤقتة، و$3.00 لكل مليون رمز إدخال جديد، و$15.00 لكل مليون رمز إخراج. هذا ما يقارب ثلاثة أضعاف سعر إدخال K2.6 وأربعة أضعاف تقريباً سعر إخراجه، ما يجعل K3 أغلى نموذج أطلقه مختبر صيني حتى الآن.

ما هي نافذة سياق Kimi K3؟

يدعم Kimi K3 نافذة سياق بمليون رمز، ويبقى التسعير ثابتاً عبر تلك النافذة كاملة. يستخدم النموذج تصميم انتباه جديداً يُسمّى Kimi Delta Attention، الذي تقول Moonshot إنه يمنح فك ترميز أسرع حتى 6.3x عند أطوال سياق بمليون رمز.

هل يمكنني تشغيل Kimi K3 محلياً؟

ليس بعد. الأوزان لن تصبح علنية حتى 27 يوليو 2026. بعد ذلك، تصبح الاستضافة الذاتية ممكنة تقنياً، لكن نموذجاً بـ2.8 تريليون معامل يحتاج عتاداً من فئة العناقيد الحاسوبية بدلاً من محطة عمل واحدة، لذا ستظل معظم الفرق تصل إليه عبر API.

هل Kimi K3 أفضل فعلاً من Fable 5؟

الأمر يعتمد على المهمة. يتفوّق K3 على Claude Fable 5 في SWE Marathon وProgram Bench والتصويت الأعمى للبرمجة الأمامية في Arena. لا يزال Fable 5 يتصدّر في FrontierSWE وHLE-Full وتصنيفات الذكاء الإجمالية العامة. كما نُفّذت كل معايير الإطلاق داخل بيئة كل شركة الخاصة، لذا تعامل مع الانتصارات على معيار واحد باعتبارها اتجاهية.

هل Kimi K3 جيد للبرمجة؟

نعم، خصوصاً في جلسات البرمجة الطويلة المستمرة وعمل الواجهات الأمامية، حيث يتصدّر حالياً. وهو قوي أيضاً في مهام الوكلاء والطرفية (terminal). العيب الرئيسي هو التكلفة: بمستوى استدلال واحد مكلف، يدفع أكثر من اللازم في الاستدعاءات البسيطة، لذا اقرنه بنماذج أرخص للعمل الروتيني عالي الحجم.

كيف يمكنني الوصول إلى Kimi K3؟

يمكنك استخدام Kimi K3 عبر تطبيق Kimi على الويب، وKimi Work، وKimi Code، أو عبر API بمعرّف النموذج kimi-k3. الواجهة متوافقة مع OpenAI-SDK، لذا فإن إضافتها إلى تكامل قائم بأسلوب OpenAI هي في معظمها مجرد تغيير في الإعدادات.

عن الكاتب

Mert Batur, Co-Founder, Techsy.io. Connect on LinkedIn.

Mert Batur هو المؤسس المشارك لـTechsy.io، حيث يقدّم الفريق وكلاء ذكاء اصطناعي، وأنظمة أتمتة، وخطوط أنابيب صوتية/SDR لعملاء B2B. يكتب عن حزمة أدوات LLM التي يستخدمها فريق Techsy فعلياً في الإنتاج.

أبرز النقاط

  • Kimi K3 هو أول نموذج مفتوح الأوزان يتبادل ضربات حقيقية مع الطليعة المغلقة، متصدّراً SWE Marathon ومتفوّقاً في التصويت الأعمى للبرمجة الأمامية في Arena على Claude Fable 5.
  • إنه قريب من الطليعة، لا متصدّراً لها. يضعه Artificial Analysis المستقل في المرتبة #4 من أصل 189، ويتأخر عن Fable 5 في أصعب اختبارات الاستدلال والبرمجة الطليعية.
  • مفتوح بالاسم، معلّق في الممارسة. لن تُنشر الأوزان حتى 27 يوليو 2026، لذا لا استضافة ذاتية ولا تقييم مستقل حتى ذلك الحين.
  • السعر أنهى عصر الذكاء الاصطناعي الصيني الرخيص. بسعر $3/$15 لكل مليون رمز، انضباط التخزين المؤقت هو ما يُبقي K3 معقول التكلفة؛ خطّط ميزانيتك لحلقة دافئة كثيفة السياق، لا لاستدعاءات باردة أحادية المرة.
  • الأفضل للبحث الوكيلي والبرمجة طويلة المدى. إذا كنت تحتاج الأوزان اليوم أو تشغّل حركة مرور عالية الحجم وحسّاسة للتكلفة، انتظر أو اختر نموذجاً أرخص. تواصل معنا إذا أردت مساعدة في اتخاذ القرار.

الوسوم

kimi k3 reviewkimi k3kimi k3 benchmarkskimi k3 pricingmoonshot aiopen-weight llm

شارك هذا المقال

مقالات ذات صلة

المزيد في ai-machine-learning

ai-machine-learning
Aug 29, 2026

أفضل وكلاء الذكاء الاصطناعي لخدمة العملاء: 8 أدوات مصنفة حسب التسليم لا الضجيج

ثمانية وكلاء ذكاء اصطناعي لخدمة العملاء مصنفون حسب جودة التسليم، وحسب ما إذا كان الروبوت يستشهد بمقال المصدر. أسعار حية سُحبت في 17 أغسطس 2026 من الصفحات الرسمية، وتشمل Intercom Fin وZendesk AI وChatbase وWeav وWatermelon وHeyy وAda وChipp.

8 دقائق قراءة قراءة
اقرأ
ai-machine-learning
Aug 22, 2026

أفضل منشئي المواقع بالذكاء الاصطناعي: قارنا 8 وننشر 2

خطة Framer Basic بسعر 10$/شهر هي الخيار الافتراضي لموقع وكالة من صفحة واحدة بين أفضل منشئي المواقع بالذكاء الاصطناعي التي قيّمناها في 17 أغسطس 2026. وDurable أسرع وصولًا إلى رابط منشور. أما Webflow فهي الوجهة عندما تكون الحاجة تحكمًا بمستوى Designer.

8 دقائق قراءة قراءة
اقرأ
ai-machine-learning
Aug 12, 2026

Grok 4.6 مقابل Grok 4.5: أجرينا 80 استدعاء API يوم الإطلاق – نتيجة متطابقة 40/40 بفاتورة 1.38×

أطلقت SpaceXAI نموذج Grok 4.6 في 12 أغسطس 2026 بنفس بطاقة أسعار Grok 4.5 وهي `$2/$6`. أرسلنا 80 استدعاء API متطابقًا إلى النموذجين في اليوم نفسه: تعادلت الدقة عند `40/40`، بينما استهلك النموذج الأحدث 1.90× من متوسط رموز الإخراج وكلّف 1.38× من المال.

8 دقائق قراءة قراءة
اقرأ
ابدأ مشروعك

هل أنت مستعد لبناء شيء استثنائي؟

دعنا نحول رؤيتك إلى واقع. فريقنا جاهز لمساعدتك في إنشاء برمجيات تصنع الفرق.