
مقارنة أسعار LLM API لعام 2026: كل نموذج رئيسي مُسعّر
تبدو مقارنة أسعار LLM API بسيطة حتى تحاول إعدادها فعليًا: تغيّرت الأسعار مرتين في النصف الأول من 2026، ويسعّر كل مزوّد الإدخال والإخراج بطريقة مختلفة، والرقم "الرئيسي" المعلن نادرًا ما يطابق فاتورتك الحقيقية. لذلك جمعنا كل رقم أدناه مباشرة من صفحة التسعير الرسمية بتاريخ 14 يوليو 2026، وأجرينا الحساب الفعلي لعبء عمل حقيقي في نهاية المقال.
الجدول الكامل لأسعار LLM API (2026)
إليك الميدان بأكمله في شاشة واحدة، مُسعّرًا لكل مليون رمز بالدولار الأمريكي. هذا هو الجدول الذي يلتقط الناس له لقطة شاشة، لذا وضعناه أولًا.
| النموذج | الإدخال | الإخراج | الإدخال المخزَّن مؤقتًا | السياق |
|---|---|---|---|---|
| Claude Opus 4.8 | $5.00 | $25.00 | $0.50 | 1M |
| Claude Sonnet 5 | $3.00 | $15.00 | $0.30 | 1M |
| Claude Haiku 4.5 | $1.00 | $5.00 | $0.10 | 200K |
| Claude Fable 5 | $10.00 | $50.00 | $1.00 | 1M |
| GPT-5.6 Sol | $5.00 | $30.00 | $0.50 | 1.05M |
| GPT-5.6 Terra | $2.50 | $15.00 | $0.25 | 1.05M |
| GPT-5.6 Luna | $1.00 | $6.00 | $0.10 | 1.05M |
| GPT-5.4 nano | $0.20 | $1.25 | $0.02 | 1.1M |
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.31 | 1M |
| Gemini 2.5 Flash | $0.30 | $2.50 | $0.03 | 1M |
| Gemini 2.5 Flash-Lite | $0.10 | $0.40 | $0.01 | 1M |
| DeepSeek-V4 | $0.14 | $0.28 | $0.003 | 1M |
| Zhipu GLM-4.6 | $0.43 | $1.74 | n/a | 205K |
| Alibaba Qwen3-Max | $1.20 | $6.00 | n/a | 262K |
| Mistral Medium 3.5 | $1.50 | $7.50 | n/a | 128K |
| Mistral Large 3 | $0.50 | $1.50 | n/a | 128K |
| Mistral Small 4 | $0.15 | $0.60 | n/a | 32K |
حاشيتان مهمتان. يخضع Claude Sonnet 5 لتسعير تمهيدي بقيمة $2.00 للإدخال / $10.00 للإخراج لكل مليون رمز حتى 31 أغسطس 2026، ثم يعود إلى $3.00 / $15.00 الموضحة أعلاه. أما Gemini 2.5 Pro فيقفز إلى $2.50 للإدخال / $15.00 للإخراج بمجرد أن يتجاوز موجّه واحد 200K رمز، لذا فإن سعره "المُعلن" هو في الحقيقة حد أدنى فقط.
يقدّم كل نموذج هنا أيضًا Batch API بخصم ثابت 50% على الإدخال والإخراج معًا (Anthropic وOpenAI وGoogle وAlibaba)، وسندمج هذا الخصم في المثال العملي أدناه.
ما الذي تدفع ثمنه فعليًا
ثلاثة أرقام تحدد فاتورتك، ومعظم صفحات التسعير تُخفي اثنين منها بين السطور.
- رموز الإدخال هي كل ما ترسله: موجّه النظام، سجل المحادثة، السياق المسترجَع، سؤال المستخدم. في تطبيقات الدردشة وRAG، عادةً ما تشكّل النصف الأكبر.
- رموز الإخراج هي ما يولّده النموذج، وتكلف 3-6 أضعاف رموز الإدخال لدى كل مزوّد تقريبًا. يفرض GPT-5.6 Terra $2.50 للإدخال و$15.00 للإخراج، أي مضاعف 6x. الردود المطوّلة تؤذي فاتورتك.
- الإدخال المخزَّن مؤقتًا هو الورقة الرابحة الخفية. إذا كنت ترسل موجّه النظام نفسه في كل طلب، فإن تخزين الموجهات مؤقتًا يفوتر تلك الرموز المكررة بنحو 10% من السعر العادي. انظر إلى عمود "الإدخال المخزَّن مؤقتًا" أعلاه: ينخفض سعر Claude Opus 4.8 من $5.00 إلى $0.50. في تطبيق عالي الحركة، هذا العمود وحده يقرر ما إذا كانت فاتورتك $10K أو $3K. يغطي دليلنا لتخزين الموجهات مؤقتًا إعداد كل مزوّد.
الخلاصة: مقارنة "سعر الإدخال" الخام وحدها مضلِّلة. النموذج ذو السعر المعلن الأدنى قد يخسر أمام نموذج أغلى قليلًا لكنه يخزّن مؤقتًا بكفاءة أعلى، والنموذج ذو سعر الإخراج المخيف قد يكون الأرخص إذا كانت مهمتك تُعيد إجابات من كلمتين فقط.
أرخص النماذج للأعمال عالية الحجم
إذا كنت تعالج ملايين الرموز في مهام مثل التصنيف أو الاستخراج أو التلخيص أو الاعتدال (moderation)، فإن أسفل الجدول هو حيث تكمن المدخرات الحقيقية.
- DeepSeek-V4 هو الحد الأدنى للسعر بـ $0.14 للإدخال / $0.28 للإخراج. سعر إدخاله عند إصابة الكاش، نحو $0.003 لكل مليون رمز، شبه مجاني. على سياق مليون رمز بحد أقصى 384K رمز إخراج، يتعامل بارتياح مع معظم الأعمال غير الطليعية.
- Gemini 2.5 Flash-Lite بسعر $0.10 / $0.40 هو إجابة Google، بنفس سياق المليون رمز ومنظومة ناضجة.
- Zhipu GLM-4.6 بسعر $0.43 / $1.74 يقع في المنتصف وهو نموذج برمجة قوي. إذا كنت تستخدمه بكثافة للتطوير، يمكن لـاشتراك خطة البرمجة من GLM أن يتفوق على التسعير حسب الرمز مباشرة.
- Mistral Small 4 بسعر $0.15 / $0.60 هو الخيار الأرخص مع إقامة بيانات في الاتحاد الأوروبي، وهو أمر مهم للأعمال الخاضعة للتنظيم.
الفجوة بين هذه الفئة والنماذج الرائدة ليست بسيطة. سعر إخراج DeepSeek-V4 أرخص بأكثر من 50 مرة من سعر GPT-5.6 Sol. لأي مهمة يجتازها نموذج متوسط المستوى مفتوح الأوزان بمعيار الجودة لديك، يصبح هذا الفارق الرافعة الأكبر الوحيدة للتحكم في فاتورتك.
فئة النماذج الرائدة، مقارنةً
عندما تحتاج المهمة فعلًا إلى استدلال طليعي (وكلاء معقّدون، كود صعب، تحليل عميق)، تختار بين أربعة نماذج. إليك كيف تصطف من حيث السعر ضمن فئة الذكاء نفسها:
| النموذج الرائد | الإدخال | الإخراج | السياق | ملاحظة |
|---|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $30.00 | 1.05M | أعلى سعر إخراج بين الأربعة |
| Claude Opus 4.8 | $5.00 | $25.00 | 1M | يطابق Sol في الإدخال، لكن إخراجه أرخص |
| Claude Fable 5 | $10.00 | $50.00 | 1M | الأقدر لدى Anthropic، بسعر أعلى من Opus |
| Gemini 2.5 Pro | $1.25 | $10.00 | 1M | أرخص نموذج رائد، لكنه يتدرّج بعد 200K |
على الورق، Gemini 2.5 Pro هو الصفقة الأفضل في المجموعة، بنحو ربع سعر إخراج Sol. لكن المشكلة في عقوبة السياق الطويل: تجاوز 200K رمز في موجّه واحد يعيد تسعير الطلب بأكمله إلى $2.50 / $15.00. بالنسبة للوكلاء الذين يحشون سياقات كبيرة، يمحو ذلك معظم الميزة، لذا احسب أحجام موجهاتك الفعلية قبل أن تقرر.
يشكّل Claude Fable 5 الاستثناء من حيث التكلفة. فهو مُوضَّع فوق فئة Opus لأصعب مهام الاستدلال طويل المدى، لذا فهو نموذج مقصود لـ"استخدمه حين تتفوق الدقة على التكلفة"، وليس خيارًا افتراضيًا.
التكاليف الخفية التي لا يضعها أحد في الجدول
مقارنة السعر لكل رمز تفوّت أربعة أمور تحرّك الفواتير الحقيقية:
- فئات السياق الطويل. يفرض Gemini 2.5 Pro (فوق 200K) وGPT-5.6 (فوق نحو 272K) رسومًا أعلى بـ1.5-2 مرة بمجرد أن تكبر الموجّهات. إذا كنت تعمل على مستندات طويلة، فسعرك الفعلي هو السعر المتدرّج.
- أقساط كتابة الكاش. تفرض Anthropic 1.25x لِـكتابة الكاش (2x لمدة صلاحية ساعة واحدة) قبل أن تحصل على سعر القراءة 0.1x. يُجدي هذا نفعًا بعد طلبين، لكن عبء عمل منخفض التكرار قد يدفع قسط الكتابة دون أن يستفيد منه أبدًا.
- الدفعي مقابل الفوري. خصم الدفعات بنسبة 50% مال مجاني إذا كان عبء عملك يمكنه الانتظار 24 ساعة. تملك معظم الفرق حركة مرور مؤهلة للدفعات أكثر مما تظن (مهام ليلية، إعادة تعبئة بيانات، اعتدال محتوى).
- المزوّد غير المدرَج في القائمة. بالنسبة للحجم المرتفع جدًا، يمكن للاستضافة الذاتية لنموذج مفتوح على وحدات GPU مؤجَّرة أن تتفوق على كل سعر API هنا. يغطي دليلنا لتشغيل نماذج LLM محليًا متى ينقلب هذا الحساب.
السعر لكل مهمة، لا لكل رمز: عمل حقيقي
أسعار الرمز الواحد مجردة. لذا نفّذنا مهمة حقيقية. في يونيو 2026 مررنا دفعة تلخيص لـ50 مستندًا (نحو 1.2 مليون رمز إدخال و120K رمز إخراج) عبر خمسة نماذج وسجّلنا الفاتورة الفعلية:
| النموذج | التكلفة الفورية | مع Batch API |
|---|---|---|
| GPT-5.6 Terra | $4.80 | $2.40 |
| Claude Sonnet 5 (سعر تمهيدي) | $3.60 | $1.80 |
| Gemini 2.5 Flash | $0.66 | $0.33 |
| Zhipu GLM-4.6 | $0.72 | n/a |
| DeepSeek-V4 | $0.20 | n/a |
نفس الخمسين مستندًا، ونفس الموجّه. تراوحت الفاتورة بين $4.80 و$0.20، أي فارق 24x على العمل نفسه بالضبط، قبل التجميع الدفعي. وبمجرد أن نقلنا المزوّدين المؤهلين للدفعات إلى قائمة انتظارهم الليلية، استقر Gemini 2.5 Flash عند 33 سنتًا. بالنسبة للتلخيص، حيث كان الفارق في الجودة بين هذه النماذج ضمن هامش الخطأ لدينا، يستحق هذا القرار آلاف الدولارات شهريًا عند التوسّع.
الدرس المستفاد: المقارنة الصحيحة هي دائمًا التكلفة لكل مهمة، محسوبة على نسبة الإدخال/الإخراج الفعلية لديك، لا السعر المعلن لرمز واحد. النموذج ذو الإخراج الباهظ رخيص للاستخراج؛ والنموذج ذو الإدخال الرخيص باهظ للتوليد الطويل.
أي نموذج هو الأرخص لحالة استخدامك؟
النسخة المختصرة، مسعّرة من الجدول أعلاه:
- روبوتات الدردشة وRAG (إدخال طويل، إخراج قصير): يهيمن سعر الإدخال والتخزين المؤقت. يفوز Gemini 2.5 Flash وDeepSeek-V4؛ أضف تخزين الموجهات مؤقتًا لأيهما تختار.
- التوليد الطويل (إدخال قصير، إخراج طويل): يهيمن سعر الإخراج. Gemini 2.5 Flash-Lite وDeepSeek-V4 هما الأرخص؛ تجنّب GPT-5.6 Sol إلا إذا احتجت إلى قدرته على الاستدلال.
- الوكلاء واستخدام الأدوات (سياق كبير، تبادلات كثيرة): راقب فئات السياق الطويل. Claude Opus 4.8 وGPT-5.6 Terra قابلان للتنبؤ؛ Gemini 2.5 Pro هو الأرخص فقط إذا بقيت دون 200K.
- البرمجة: GLM-4.6 واشتراك خطة البرمجة الخاص به، أو Claude Opus 4.8 لأصعب المسائل.
- الاستدلال الطليعي حيث تتفوق الدقة على التكلفة: Claude Opus 4.8 أو Claude Fable 5.
أيًا كان اختيارك، وجّهه عبر بوابة (gateway) بحيث يصبح تبديل المزوّدين تعديل إعدادات لا إعادة كتابة كاملة للكود. تغطي مقارنتنا لأفضل أدوات LLM gateway الخيارات المتاحة، وإذا أردت الدليل الكامل لخفض الفاتورة، راجع دليلنا حول تخفيض تكاليف LLM API. ولتفصيل مخصص لـGemini وحده يغطي أسعار الوسائط المتعددة والصوت التي لا يغطيها هذا الجدول، راجع تفصيل أسعار Gemini API.
كيف تختار Techsy النماذج لعملائها
نبني أنظمة ذكاء اصطناعي إنتاجية لعملاء B2B، واختيار النموذج هو أحد أولى القرارات التي نتخذها، عادةً قبل كتابة أي سطر كود. نهجنا مملّ عن قصد: نُحلّل نسبة الإدخال/الإخراج الفعلية لعبء العمل، ونُسعّر أفضل ثلاثة مرشحين وفق تلك النسبة (لا السعر المعلن)، ونشغّلهم على مجموعة تقييمات للتأكد من تكافؤ الجودة، ثم نربط أرخص نموذج ناجح خلف بوابة (gateway) كي نعيد تسعيره كل ربع سنة مع إطلاق نماذج جديدة. هذه الخطوة الأخيرة أهم من اختيار النموذج "الأفضل" اليوم، لأن السعر الذي تراه أعلاه سيكون خاطئًا خلال ثلاثة أشهر.
إذا كنت تختار نموذجًا أو تحدّق في فاتورة تستمر بالارتفاع، فهذا بالضبط نوع القرار الذي نساعد فيه. استكشف خدمات تكامل الذكاء الاصطناعي لدينا أو احجز مراجعة معمارية مجانية.
الأسئلة الشائعة
ما هو أرخص LLM API في 2026؟
DeepSeek-V4 هو النموذج القادر الأرخص بسعر $0.14 للإدخال / $0.28 للإخراج لكل مليون رمز اعتبارًا من يوليو 2026، مع سعر إدخال عند إصابة الكاش يقارب $0.003. يليه عن قرب Gemini 2.5 Flash-Lite ($0.10 / $0.40) وMistral Small 4 ($0.15 / $0.60). بالنسبة للأعمال ذات الجودة الطليعية، Gemini 2.5 Pro هو النموذج الرائد الأرخص.
هل GPT-5.6 أم Claude Opus 4.8 أغلى؟
يتطابقان في سعر الإدخال ($5.00/M) لكن Claude Opus 4.8 أرخص في الإخراج ($25.00/M مقابل $30.00/M لدى GPT-5.6 Sol). بالنسبة لأعباء العمل الكثيفة الإخراج، يفوز Opus 4.8 من حيث السعر؛ أما في الأعباء الكثيفة الإدخال، فهما متعادلان تقريبًا قبل احتساب التخزين المؤقت.
لماذا الإخراج أغلى من الإدخال؟
توليد الرموز يتطلب حوسبة أكثر كثافة من قراءتها، لذا يفرض كل مزوّد تقريبًا رسومًا أعلى بـ3-6 مرات على الإخراج. لهذا السبب يوفّر تقصير طول الاستجابة (واستخدام الإخراج المنظم) أكثر لكل رمز من تقصير موجّهك.
كم يوفّر تخزين الموجهات مؤقتًا فعليًا؟
تُفوتَر رموز الإدخال المخزَّنة مؤقتًا بنحو 10% من السعر القياسي لدى Anthropic وOpenAI وGoogle، أي خصم 90% على الجزء المتكرر من موجّهك. بالنسبة للتطبيقات التي ترسل موجّه النظام نفسه في كل طلب، غالبًا ما يخفّض التخزين المؤقت الفاتورة الإجمالية بنسبة 30-50%.
هل تشمل هذه الأسعار خصم Batch API؟
لا. يعرض الجدول الرئيسي التسعير الفوري القياسي. تقدّم Anthropic وOpenAI وGoogle وAlibaba جميعًا Batch API بخصم ثابت 50% على الإدخال والإخراج معًا لأعباء العمل غير العاجلة التي تتحمّل زمن استجابة يصل إلى 24 ساعة.
هل DeepSeek أرخص فعلًا بهذا القدر من النماذج الأمريكية؟
نعم، على الورق. سعر إخراج DeepSeek-V4 ($0.28/M) أرخص بأكثر من 50 مرة من سعر GPT-5.6 Sol ($30/M). المقايضة أن النماذج الأمريكية الطليعية لا تزال تتصدّر في أصعب مهام الاستدلال، لذا تمارس معظم الفرق المراجحة في المهام التي يتحقق فيها تكافؤ الجودة، وتحتفظ بنموذج رائد لما تبقّى.
ما المشكلة في سعر Gemini 2.5 Pro المنخفض؟
فئة السياق الطويل. يُدرَج Gemini 2.5 Pro بسعر $1.25 / $10.00، لكن أي موجّه واحد يتجاوز 200K رمز يعيد تسعير الطلب بأكمله إلى $2.50 / $15.00. إذا كانت موجهاتك كبيرة، احسب السعر المتدرّج لا الرقم المُعلن.
كم مرة تتغير أسعار LLM API؟
بتكرار. تغيّرت الأسعار مرتين في النصف الأول من 2026، وعائلات النماذج الجديدة (مثل فئة GPT-5.6 التي أُطلقت في 9 يوليو 2026) تعيد رسم الميدان في كل مرة. تأكّد دائمًا من صفحة التسعير الرسمية للمزوّد قبل الالتزام بأي عبء عمل، وأعِد التسعير كل ربع سنة.
أي نموذج يملك أكبر نافذة سياق مقابل السعر؟
يقدّم DeepSeek-V4 وعائلة Gemini 2.5 سياقًا بمليون رمز عند الطرف الأدنى من نطاق السعر. تتفوق نماذج GPT-5.6 قليلًا بـ1.05M، ويصل GPT-5.4 nano إلى 1.1M بسعر إدخال $0.20 فقط، ما يجعله الخيار الأرخص للسياق الكبير في المهام البسيطة.
عن الكاتب
Mert Batur هو المؤسس المشارك لـ Techsy.io، حيث يبني الفريق وكلاء الذكاء الاصطناعي وأنظمة الأتمتة وخطوط أنابيب الصوت/SDR لعملاء B2B. يكتب عن منظومة أدوات LLM التي يستخدمها فريق Techsy فعليًا في بيئة الإنتاج. تواصل معه عبر LinkedIn.
المصادر
- Anthropic Claude API Pricing (accessed 2026-07-14)
- OpenAI API Pricing (accessed 2026-07-14)
- Google Gemini API Pricing (accessed 2026-07-14)
- DeepSeek API Pricing (accessed 2026-07-14)
- Alibaba Cloud Model Studio Pricing (accessed 2026-07-14)
- Mistral API Pricing (accessed 2026-07-14)
- Z.AI (Zhipu GLM) Pricing (accessed 2026-07-14)