ai-machine-learning

توقّف عن إدارة 3 مفاتيح API: 10 أدوات LLM Gateway مرتبة لعام 2026

بقلم Mert Batur
تم التحديث Jul 25, 2026
30 قراءة
توقّف عن إدارة 3 مفاتيح API: 10 أدوات LLM Gateway مرتبة لعام 2026

أفضل 10 أدوات LLM Gateway، مرتبةً: الوصول إلى أي نموذج عبر واجهة API واحدة [2026]

آخر تحديث: 19 يوليو 2026. أعدنا التحقق من الأسعار وأعداد نجوم GitHub لجميع البوابات الـ9، وأضفنا تغييرَين في الملكية يهمّان كل من يختار بوابةً اليوم: أكملت Palo Alto Networks استحواذها على Portkey في 29 مايو 2026 ودمجتها في منصة Prisma AIRS الأمنية، واستحوذت Mintlify على Helicone في مارس 2026 فوضعت منتجها السحابي في وضع الصيانة. كما اكتشفنا أن مشرفي TensorZero أرشفوا المشروع في يونيو 2026، فأشرنا إلى ذلك أدناه بدل التظاهر بأنه ما زال خياراً نشطاً. ونما Bifrost من نحو 2,000 إلى 6,600 نجمة على GitHub منذ آخر مراجعة لنا وأطلق MCP Gateway خاصاً به، ما قلّص كثيراً من فجوة الحوكمة بينه وبين Portkey وTrueFoundry، لذلك أضفنا مقارنةً مباشرةً بينهما.

أفضل بوابة LLM في 2026 هي LiteLLM للفرق ذات الاستضافة الذاتية وMerge Gateway لحركة مرور الإنتاج المُدارة. يدعم LiteLLM أكثر من 100 مزوّد خلف واجهة API واحدة متوافقة مع OpenAI، ويتعامل مع التراجعات وضوابط الميزانية، ويعمل مجاناً على أي VPS. تُصبح Merge Gateway الخيار المُدار بمجرد أن تتحول نفقات LLM إلى مسألة هامش ربح: سياسات توجيه حسب العميل أو الميزة، وحدود ميزانية، وفوترة موحّدة، وتحديد التكلفة على مستوى كل طلب. وإن كنت تريد ببساطة أوسع كتالوج نماذج بلا أي إعداد، لا يزال OpenRouter يمنحك وصولاً فورياً إلى أكثر من 300 نموذج ويبقى المكان الأفضل لبناء النماذج الأولية. للمؤسسات المنظَّمة التي تحتاج سيادة البيانات وحوكمة حركة مرور النماذج والوكلاء معاً، تعمل TrueFoundry داخل VPC الخاص بك بالكامل. لحواجز حماية الإنتاج (تنقيح PII، كشف التحايل)، Portkey هو الخيار. للإنتاجية الخام التي تتجاوز 5,000 RPS، تضيف معمارية Go في Bifrost 11 ميكروثانية فقط من العبء.

أنت تستدعي OpenAI لروبوت الدردشة، وAnthropic لمساعد البرمجة، وGemini لخط أنابيب التلخيص. ثلاثة مفاتيح API، وثلاثة حزم SDK، وثلاثة لوحات فواتير، وثلاثة مجموعات من معالجة الأخطاء. أضف الآن منطق التراجع حين يتعطل أحد المزودين. هذه هي الفوضى التي تحلّها بوابات LLM, واجهة API موحّدة واحدة تُوجّه إلى أي نموذج، وتتتبع التكاليف، وتتعامل مع الأعطال تلقائياً.

اختبرنا جميع بوابات LLM الرئيسية ورتّبناها وفق ما يهم فعلاً: عبء زمن الاستجابة، وتغطية المزودين، وسهولة الإعداد، وما إذا كانت ستصمد أمام موجة الحركة التالية.

الترتيبالأداةالأفضل لـالنوعالسعر الابتدائي
no. 1LiteLLMأقصى مرونةاستضافة ذاتية (مفتوح المصدر)مجاني
no. 2Merge Gatewayتوجيه على نطاق المؤسسات والتحكم في الإنفاقSaaS مُدارالدفع لكل رمز (مستوى مجاني)
no. 3TrueFoundryحوكمة مؤسسية + MCPاستضافة ذاتية + مُدارةمستوى مجاني (499 $/شهر Pro)
no. 4OpenRouterوصول متعدد النماذج بلا إعدادSaaS مُدارالدفع لكل رمز
no. 5Portkeyضمانات بيئة الإنتاجهجين (مفتوح المصدر + مُدار)مستوى مجاني
no. 6Heliconeالفرق المهتمة بالمراقبةاستضافة ذاتية (مفتوح المصدر)مجاني
no. 7Bifrostأداء الإنتاجية الخاماستضافة ذاتية (مفتوح المصدر)مجاني
no. 8Cloudflare AI Gatewayالتوجيه بلا بنية تحتيةمُدارمستوى مجاني
no. 9Kong AI Gatewayفرق إدارة APIاستضافة ذاتية + مؤسسيمجتمع مجاني
no. 10TensorZeroتوجيه مُحسَّن بالتعلم الآلي (مؤرشف منذ يونيو 2026)استضافة ذاتية (مفتوح المصدر، غير مُصان)مجاني

ما هي بوابة LLM؟ (وهل تحتاجها فعلاً؟)

قبل الترتيبات، تمييز سريع. يستخدم الناس "gateway" و"proxy" و"router" بالتبادل، لكنها تؤدي أدواراً مختلفة قليلاً:

  • LLM Proxy: يُعيد توجيه الطلبات إلى المزودين ويضيف التسجيل. منطق أدنى.
  • LLM Router: يختار أفضل نموذج أو مزوّد لكل طلب بناءً على التكلفة أو زمن الاستجابة أو المحتوى.
  • LLM Gateway: الحزمة الكاملة, proxy + router + تتبع التكاليف + التخزين المؤقت + الضمانات + المراقبة.

معظم الأدوات في هذه القائمة بوابات كاملة، لكن بعضها يميل أكثر نحو نطاق الـ proxy أو الـ router.

تحتاج إلى بوابة إذا:

  1. كنت تستدعي 2+ مزودي LLM وتريد واجهة API واحدة للجميع
  2. تحتاج إلى تتبع التكاليف عبر المزودين (من يحرق ميزانيتك؟)
  3. تريد تحويلاً تلقائياً عند تعطل أحد المزودين
  4. تبني ميزات تستفيد من تخزين الطلبات مؤقتاً عبر المزودين

إذا كنت تستخدم مزوداً واحداً فقط ولا تخطط للتبديل، فإن البوابة تضيف تعقيداً غير ضروري. تجاوزها.

مسار التبني النموذجي: تبدأ معظم الفرق بترميز استدعاءات OpenAI مباشرةً. ثم تضيف Anthropic لحالة استخدام ثانية وتكتب دالة مُغلِّفة. ثم تحتاج إلى منطق تراجع، وتتبع تكاليف، وتحديد معدل, وفجأة بنت لنفسها بوابة منزلية نصف مخبوزة. الأدوات أدناه تستبدل تلك الفوضى المنزلية بشيء مُختبَر في المعارك.

1. LiteLLM, الأفضل إجمالاً

نجوم GitHub: ~54K | اللغة: Python | الترخيص: MIT

LiteLLM هو السكين السويسرية لبوابات LLM. يُغلّف 100+ مزوّد LLM خلف واجهة API واحدة متوافقة مع OpenAI، مما يعني أن كود SDK الخاص بـ OpenAI يعمل دون تغييرات. فقط أبدل عنوان URL الأساسي.

مكوّن خادم الـ proxy هو ما يجعل LiteLLM بوابةً وليس مجرد SDK. تنشره كخدمة مستقلة، وتضبط نماذجك في ملف YAML، وكل فريق يصل إلى نفس نقطة النهاية مع تتبع التكاليف وتحديد المعدل وموازنة الحمل مدمجةً.

python
# config.yaml لـ LiteLLM proxy
model_list:
  - model_name: gpt-4
    litellm_params:
      model: openai/gpt-4o
      api_key: sk-...
  - model_name: gpt-4
    litellm_params:
      model: anthropic/claude-sonnet-4-20250514
      api_key: sk-ant-...
  # LiteLLM يوازن الحمل تلقائياً بين هذه

general_settings:
  master_key: sk-my-master-key
  database_url: postgresql://...
python
# كود تطبيقك لا يتغير -- فقط أشر إلى الـ proxy
from openai import OpenAI

client = OpenAI(
    base_url="http://localhost:4000",  # LiteLLM proxy
    api_key="sk-my-master-key"
)

response = client.chat.completions.create(
    model="gpt-4",  # يُوجَّه إلى OpenAI أو Anthropic عبر الإعداد
    messages=[{"role": "user", "content": "اشرح بوابات LLM"}]
)

ما هو رائع:

  • دعم 100+ مزوّد (أوسع تغطية بين جميع البوابات)
  • واجهة API متوافقة مع OpenAI, صفر تغييرات في الكود للتطبيقات الموجودة
  • تتبع التكاليف المدمج، ميزانيات لكل فريق/مستخدم
  • سلاسل التراجع: إذا فشل OpenAI، جرّب Anthropic، ثم Gemini
  • يتكامل مع جميع أدوات المراقبة الرئيسية (Langfuse, Helicone, إلخ)

ما هو أقل جودة:

  • GIL في Python يحدّ من الإنتاجية أحادية العملية (زمن استجابة P95 ~8ms عند 1000 RPS)
  • يحتاج الـ proxy قاعدة بيانات PostgreSQL خاصة لميزات إدارة الفريق
  • قد يصبح الإعداد معقداً مع نماذج وقواعد توجيه كثيرة
  • هجوم على سلسلة التوريد في 24 مارس 2026: زُرع باب خلفي في إصدارَين على PyPI (1.82.7 و1.82.8) بعد أن سرق المهاجمون بيانات اعتماد النشر عبر إجراء CI مُخترَق. عزلت PyPI الإصدارَين خلال نحو 40 دقيقة، لكن ثبّت إصدارك وتحقق بـ pip show litellm إن كنت قد نشرت في ذلك اليوم. التفاصيل الكاملة في تقرير الحادثة من LiteLLM

التسعير: مجاني ومفتوح المصدر. خطط مؤسسية متاحة للاستضافة المُدارة.

إذا قرأت دليلنا حول استخدام Claude Code مع نماذج مختلفة، فقد رأيت LiteLLM في العمل, هو أحد الطرق الرئيسية التي يُوجّه بها المطورون Claude Code عبر مزودين بديلين. يرشدك دليل إعداد LiteLLM proxy خطوةً بخطوة خلال نشر Docker الكامل مع PostgreSQL في أقل من 20 دقيقة.

الحكم: LiteLLM هو أفضل بوابة LLM إجمالاً للفرق التي تريد أقصى مرونة ولا تمانع الاستضافة الذاتية. لديها أوسع تغطية للمزودين، وأكثر النظم البيئية نضجاً، وأكبر مجتمع. ابدأ من هنا ما لم يكن لديك سبب محدد لعدم ذلك.

2. Merge Gateway, الأفضل لتوجيه حركة المرور والتحكم في الإنفاق على نطاق المؤسسات

المزودون: OpenAI، Anthropic، Google، AWS Bedrock، Mistral، Cohere، Grok | النوع: SaaS مُدار | الإطلاق: 31 مارس 2026

Merge Gateway مبنيّة للحظة التي تتوقف فيها نفقات LLM عن كونها بنداً في الميزانية وتتحول إلى مشكلة في الهامش الربحي. بينما يُحسِّن OpenRouter من اتساع الوصول إلى النماذج، تُحسِّن Merge التحكم في حركة المرور التي تُشغّلها بالفعل في بيئة الإنتاج: التوجيه حسب التكلفة أو زمن الاستجابة أو الجودة أو العميل أو الميزة أو المنطقة، وميزانيات تُفعَّل قبل وصول الفاتورة، وسجلّات على مستوى الطلب تخبرك أي نموذج خدم استدعاءً معيناً ولماذا وُجِّه إليه.

وهذا الجزء الأخير هو الفارق الحقيقي. معظم البوابات تستطيع إخبارك بما أنفقته. أما Merge فمبنيّة لتخبرك على من أنفقته، وهو السؤال الذي يظهر بمجرد أن يبدأ استخدام عميل مؤسسي واحد في التهام الهامش الإجمالي لمنتجك.

python
from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api-gateway.merge.dev/v1/openai",
)

response = client.chat.completions.create(
    model="gpt-4o",
    messages=[{"role": "user", "content": "Summarize this support ticket"}],
)

ما هو رائع:

  • سياسات توجيه حسب العميل أو الميزة أو المنطقة أو حالة الاستخدام أو التكلفة أو زمن الاستجابة أو الجودة
  • التحويل الاحتياطي التلقائي يُبقي ميزات الذكاء الاصطناعي حيّة أثناء انقطاعات المزوّدين وحدود المعدل والتراجع في الأداء
  • مراقبة على مستوى الطلب: النموذج، المزوّد، التكلفة، زمن الاستجابة، وسبب التوجيه خلف كل استدعاء
  • حوكمة التكلفة بميزانيات وحدود إنفاق وتنبيهات حسب المشروع أو الفريق أو فئة العميل أو الميزة
  • التخزين المؤقت الدلالي وضغط السياق كأدوات أساسية لخفض التكلفة، لا كإضافات ثانوية

ما هو أقل جودة:

  • ليست مفتوحة المصدر، فتخرج من الحسبان إذا كانت الاستضافة الذاتية متطلباً صارماً (توفر نسخة Enterprise VPC أو نشراً محلياً، لكن ذلك يتطلب محادثة مبيعات)
  • موجَّهة لبيئة الإنتاج بالتصميم، ما يجعلها أثقل مما يلزم للنماذج الأولية والتطبيقات منخفضة الحجم
  • أُطلقت في مارس 2026، لذا المجتمع والتكاملات والدروس التعليمية من أطراف ثالثة لا تزال محدودة مقارنةً بـ LiteLLM أو OpenRouter

التسعير: مستوى مجاني برصيد 10 $/شهرياً، بلا بطاقة ائتمان. Pro يكلّف تكلفة LLM + 5% بلا سقف إنفاق ومع bring-your-own-key. يُسعَّر Enterprise حسب الطلب ويضيف نشر VPC أو محلياً، ومدير حساب مخصص، واتفاقيات مستوى خدمة لوقت التشغيل. تُصدَر الأرصدة في اليوم الأول من كل شهر ولا تُرحَّل.

جدير بالذكر بخصوص الرسوم: نسبة 5% من Merge تقع بالكاد تحت نسبة 5.5% من OpenRouter. عند حجم النماذج الأولية، هذا الفارق مجرد ضجيج. أما عند إنفاق استدلال سنوي بستة أرقام، فهو مبلغ حقيقي، وهو نوع الحساب الذي يستحق النمذجة قبل الالتزام بأي الجانبين.

الحكم: Merge Gateway هو الخيار حين تتحول حركة مرور LLM لديك إلى مشكلة موثوقية وهامش ربح لا مشكلة تكامل. إن كنت بحاجة للإجابة عن سؤال "أي عميل يقود الإنفاق" أو "أي ميزة تعمل بخسارة"، وتريد سياسات تحويل احتياطي تُبقي الميزات حيّةً أثناء حادثة انقطاع لدى أحد المزودين، فهو أقوى خيار مُدار هنا. وإن كنت لا تزال تُقرر أي النماذج ستستخدم، فكتالوج OpenRouter يخدمك أفضل، ويمكنك الانتقال لاحقاً.

3. TrueFoundry, الأفضل للحوكمة المؤسسية

النماذج: 1,600+ | المزودون: 250+ | النوع: استضافة ذاتية + مُدارة | النشر: VPC، محلي، معزول هوائياً

بوابة الذكاء الاصطناعي من TrueFoundry مصمَّمة للسيناريو الذي تُعاني منه البوابات مفتوحة المصدر: المؤسسة المنظَّمة التي تحتاج لوحة تحكم واحدة لكل نموذج، وسيادة كاملة للبيانات، ومسارات تدقيق تجتاز أي مراجعة امتثال. تعمل داخل VPC الخاص بك أو على البنية التحتية المحلية أو في بيئة معزولة هوائياً، فلا تغادر بيانات الطلبات نطاقك، وتأتي مدمجةً بالامتثال لـ SOC 2 وHIPAA وGDPR، وتسجيل الدخول الموحّد (SSO)، والتحكم في الوصول المبني على الأدوار (RBAC) من الصندوق.

التغطية من أوسع ما في هذه القائمة: 1,600+ نموذج عبر 250+ مزوّد (OpenAI وAnthropic وGemini وGroq وMistral)، إضافةً إلى الخلفيات ذاتية الاستضافة كـ vLLM وSGLang وTriton. تُفيد TrueFoundry بزمن استجابة داخلي أقل من 3ms تحت الأحمال المؤسسية وتوافر 99.99% عبر أكثر من 10 مليارات طلب شهرياً، ما يعني أن طبقة الحوكمة لا تكلّفك الإنتاجية.

python
from openai import OpenAI

client = OpenAI(
    base_url="https://<your-org>.truefoundry.com/api/llm",  # your gateway
    api_key="tfy-..."
)

response = client.chat.completions.create(
    model="openai/gpt-4o",  # routed, logged, and rate-limited centrally
    messages=[{"role": "user", "content": "Summarize this contract"}]
)

ما يميّز TrueFoundry عن Portkey أو LiteLLM هو MCP Gateway: سجل مركزي يحكم كيفية وصول وكلاء الذكاء الاصطناعي إلى أدوات المؤسسة (Slack وGitHub وConfluence وDatadog) عبر بروتوكول سياق النموذج. تُسجّل الواجهات البرمجية الداخلية كخوادم MCP، وتُؤمّنها خلف Okta أو Azure AD بتحكم في الوصول على مستوى كل خادم، وتحصل على تتبع على مستوى الطلب لكل استدعاء أداة. هذا يمنحك لوحة تحكم موحّدة ومحكومة لحركة مرور النماذج وحركة مرور أدوات الوكلاء، وهو ما يهم فعلاً حين تبدأ الوكلاء في اتخاذ إجراءات، لا مجرد توليد نصوص.

على عكس معظم بوابات المؤسسات، تنشر TrueFoundry أسعارها علناً. يغطي مستوى Developer المجاني 50,000 طلب شهرياً، و3 مستخدمين، وMCP Gateway حتى 5 خوادم، وهو ما يكفي لبناء نموذج أولي للحزمة كاملة قبل التحدث إلى أي شخص. يكلّف مستوى Pro مبلغ 499 $/شهرياً مقابل مليون طلب، و10 مستخدمين، والتخزين المؤقت الدلالي، والنماذج الافتراضية، والتوجيه المتقدم، مع فوترة الاستخدام الإضافي بأسعار وحدة شفافة. يكلّف Pro Plus مبلغ 2,999 $/شهرياً ويضيف بيانات وصفية مخصصة، وتنبيهات، وتصدير المراقبة لـ 25 مستخدماً. يُسعَّر Enterprise حسب الطلب لأكثر من 10 ملايين طلب، مع عمليات تثبيت كاملة عبر VPC ومتعددة المناطق ومعزولة هوائياً لكلٍّ من لوحة التحكم ولوحة البوابة. تتضمن كل خطة مدفوعة تجربة مجانية لمدة 7 أيام. لا تتطلب خدمة SaaS المُدارة أي تكلفة استضافة؛ وإذا استضفت البوابة ذاتياً داخل سحابتك الخاصة (BYOC)، فخصّص نحو 600 إلى 1,000 $ شهرياً للبنية التحتية الأساسية.

ما هو رائع:

  • 1,600+ نموذج، 250+ مزوّد، بالإضافة إلى الخلفيات ذاتية الاستضافة (vLLM, SGLang, Triton)
  • يعمل داخل VPC الخاص بك أو محلياً أو في بيئة معزولة هوائياً؛ لا تغادر البيانات نطاقك
  • امتثال SOC 2 وHIPAA وGDPR، وSSO، وRBAC، وتسجيل التدقيق مدمجة
  • ضمانات: تصفية PII، كشف السمية، مسح حقن الطلبات
  • MCP Gateway يحكم وصول الوكلاء إلى الأدوات، وليس استدعاءات النموذج فقط
  • تسعير عام وشفاف مع مستوى Developer مجاني فعلياً (50 ألف طلب/شهر)
  • تُفيد TrueFoundry بخفض متوسط التكلفة ~30% عبر التوجيه والتخزين المؤقت والميزانيات

ما هو أقل جودة:

  • موجَّه للمؤسسات أولاً: أثقل من LiteLLM أو OpenRouter للمشاريع الصغيرة
  • المنصة الأساسية مملوكة (مستودعاتها مفتوحة المصدر أدوات بنية تحتية منفصلة)
  • استضافة البوابة ذاتياً تضيف نحو 600 إلى 1,000 $ شهرياً من تكاليف البنية التحتية فوق خطتك
  • القيمة الأعلى تظهر حين يكون لديك فرق وأدوات كثيرة لحوكمتها، وليس في اليوم الأول

التسعير: مستوى Developer مجاني (0 $/شهر، 50 ألف طلب، 3 مستخدمين). Pro بسعر 499 $/شهر (مليون طلب، 10 مستخدمين، تخزين مؤقت دلالي، توجيه متقدم). Pro Plus بسعر 2,999 $/شهر (25 مستخدماً، مراقبة متقدمة). Enterprise مخصص (أكثر من 10 ملايين طلب، VPC كامل ومعزول هوائياً). تجربة 7 أيام في الخطط المدفوعة؛ خدمة SaaS المُدارة بلا تكلفة استضافة، والاستضافة الذاتية تضيف ~600-1,000 $/شهر بنية تحتية.

الحكم: TrueFoundry هي البوابة للمؤسسات التي تحتاج لوحة تحكم موحّدة ومحكومة لحركة مرور النماذج والوكلاء معاً، مع احتفاظ البيانات داخل بنيتها التحتية. إذا كنت شركة ناشئة تربط مزوّدَين، فهي أكثر مما تحتاج، ابدأ بـ LiteLLM. إذا كنت فريقاً مؤسسياً تطرح الذكاء الاصطناعي على عشرات الفرق الداخلية تحت تفويض امتثال، فهي تستحق وضعها على قائمتك القصيرة.

4. OpenRouter, الأفضل لوصول متعدد النماذج بلا إعداد

النماذج: 300+ | النوع: SaaS مُدار | الترخيص: مملوك

يأخذ OpenRouter النهج المعاكس تماماً لـ LiteLLM: لا تنشر أي شيء. سجّل، احصل على مفتاح API، وستحصل على وصول فوري إلى 300+ نموذج من جميع المزودين الرئيسيين عبر نقطة نهاية واحدة. إنه "متجر تطبيقات" واجهات API للـ LLM.

عرض القيمة هو البساطة. لا بنية تحتية للصيانة، ولا تكوينات YAML للكتابة، ولا قواعد بيانات للتوفير. تدفع رصيداً مسبقاً أو تربط بطاقة، ويتولى OpenRouter الفوترة الموحّدة عبر جميع المزودين.

python
from openai import OpenAI

client = OpenAI(
    base_url="https://openrouter.ai/api/v1",
    api_key="sk-or-..."
)

# الوصول إلى أي نموذج من أي مزوّد -- نفس الكود
response = client.chat.completions.create(
    model="anthropic/claude-sonnet-4-20250514",
    messages=[{"role": "user", "content": "قارن بوابات LLM"}]
)

ما هو رائع:

  • 300+ نموذج، مفتاح API واحد، لوحة فواتير واحدة
  • 25+ نموذج مجاني للنماذج الأولية (بعضها بقدرات مفاجئة)
  • لا بنية تحتية للإدارة, سجّل وابدأ الاستدعاء
  • ميزات مقارنة النماذج تساعدك على التقييم قبل الالتزام
  • يتعامل مع انقطاعات المزودين بتوجيه تراجع تلقائي

ما هو أقل جودة:

  • رسوم منصة 5.5% فوق سعر المزوّد, تتراكم على نطاق واسع
  • لا خيار استضافة ذاتية, بياناتك تمر عبر خوادم OpenRouter
  • مراقبة محدودة مقارنةً بأدوات البوابة المخصصة
  • قد تكون حدود المعدل في المستوى المجاني مقيّدة لأحمال عمل الإنتاج
  • لا منطق توجيه مخصص, تحصل على ما يقرره OpenRouter

التسعير: الدفع لكل رمز (سعر المزوّد + 5.5% رسوم). لا حدود دنيا شهرية. 25+ نموذج مجاني متاح.

الحكم: OpenRouter هو أسرع طريقة للوصول إلى مزودي LLM متعددين. إذا أردت إنشاء نماذج أولية بنماذج مختلفة أو تشغيل حمل عمل صغير إلى متوسط دون إدارة بنية تحتية، فهو الخيار الواضح. على نطاق واسع، تبدأ رسوم 5.5% في الأهمية. إذا كان تقليل التكاليف هو المحرك، اطّلع على دليلنا لتقليل تكاليف LLM API للحصول على تحليل شامل لآليات التخزين المؤقت والمعالجة الدفعية وتوفير التكاليف على مستوى البوابة.

5. Portkey, الأفضل لضمانات بيئة الإنتاج

نجوم GitHub: ~12K | اللغة: TypeScript/Node.js | الترخيص: Apache 2.0 (البوابة)، منصة مُدارة

يُقدّم Portkey نفسه كـ"طائرة التحكم للذكاء الاصطناعي". بينما يركز LiteLLM على التوجيه وOpenRouter على البساطة، الميّز لـ Portkey هو أمان الإنتاج: ضمانات، وتنقيح PII، وكشف التحايل، ومسارات التدقيق مدمجةً في طبقة البوابة.

اعتباراً من مارس 2026، جعل Portkey بوابته بالكامل مفتوحة المصدر (Apache 2.0)، حتى تتمكن من استضافة التوجيه الأساسي والضمانات ذاتياً بدون المنصة المُدارة. لكن التغيير الأكبر جاء في 29 مايو 2026، حين أكملت Palo Alto Networks استحواذها على Portkey ودمجتها في Prisma AIRS، منصتها الأمنية الخاصة بوكلاء الذكاء الاصطناعي. لا تزال البوابة مفتوحة المصدر تصدر تحت Apache 2.0، ولا تزال الخطط المُدارة تعمل بالطريقة نفسها، لكن Portkey لم تعد شركة بنية تحتية مستقلة للذكاء الاصطناعي، بل صارت مكوّناً داخل خط منتجات شركة أمن سيبراني، وهذا يهمّ إن كنت تُقيّم استقلالية خارطة الطريق على المدى الطويل.

python
from portkey_ai import Portkey

portkey = Portkey(
    api_key="pk-...",
    config={
        "strategy": {"mode": "fallback"},
        "targets": [
            {"provider": "openai", "override_params": {"model": "gpt-4o"}},
            {"provider": "anthropic", "override_params": {"model": "claude-sonnet-4-20250514"}}
        ]
    }
)

response = portkey.chat.completions.create(
    messages=[{"role": "user", "content": "لخّص هذا المستند"}]
)

ما هو رائع:

  • دعم 1,600+ نموذج عبر المزودين
  • ضمانات مدمجة: كشف PII، منع التحايل، تصفية المحتوى
  • إدارة الطلبات والإصدار داخل البوابة
  • طبقة التخزين المؤقت تقلل الاستدعاءات المتكررة (يوفر المال وزمن الاستجابة)
  • مسارات التدقيق وميزات الامتثال للصناعات الخاضعة للتنظيم
  • البوابة الآن مفتوحة المصدر بالكامل (مارس 2026)

ما هو أقل جودة:

  • تسعير المنصة المُدارة يبدأ بـ $49/شهر لميزات الإنتاج
  • المستوى المؤسسي ($5,000–$10,000/شهر) للحوكمة المتقدمة
  • المنصة تضيف تعقيداً يتجاوز ما تقدمه البوابات الأبسط
  • منحنى التعلم أكثر حدةً من LiteLLM أو OpenRouter
  • مملوكة الآن لـ Palo Alto Networks (استحوذت عليها في مايو 2026)، لذا تخضع خارطة طريقها لأولويات شركة أمن، لا لأولويات مستخدمي البنية التحتية للذكاء الاصطناعي وحدهم. والفرق التي تريد البقاء بمنأى عن ذلك تتجه أكثر فأكثر إلى Bifrost أو LiteLLM، انظر المقارنة المباشرة أسفل هذه الصفحة

التسعير: البوابة مفتوحة المصدر مجانية للاستضافة الذاتية. المنصة المُدارة: مستوى Developer مجاني إلى الأبد (10,000 سجل/شهر، احتفاظ 3 أيام). مستوى Production بسعر $49/شهر (100,000 سجل/شهر، احتفاظ 30 يوماً، ضمانات، RBAC، تخزين مؤقت دلالي، $9 لكل 100,000 سجل إضافي). Enterprise بتسعير مخصص (أكثر من 10 ملايين سجل/شهر، استضافة VPC، SOC 2 Type 2، HIPAA).

الحكم: Portkey لا يزال البوابة للفرق التي تبني ميزات LLM مواجهة للعملاء ولا يمكنها تحمّل حقن الطلبات أو تسريب PII أو تكاليف غير مراقبة، والضمانات تبرر التعقيد. ما تغيّر هو الجهة التي تقف خلفه: منذ استحواذ Palo Alto Networks، صار Portkey أنسب للفرق الموجودة أصلاً داخل منظومة Prisma AIRS أو المرتاحة للعمل ضمنها. وإن أردت بوابة مفتوحة المصدر بقدرات مماثلة تبقى مستقلة، فإن Bifrost هو الأجدر بالنظر.

6. Helicone, الأفضل للفرق المهتمة بالمراقبة

نجوم GitHub: ~6K | اللغة: Rust | الترخيص: Apache 2.0

بدأ Helicone كأداة مراقبة وتطوّر إلى بوابة كاملة. قصة الأصل تلك مهمة, ميزات المراقبة والتحليلات من الدرجة الأولى، وميزات البوابة (التوجيه، والتخزين المؤقت، والتحويل) بُنيت على أساس مراقبة راسخ.

كونه مكتوباً بـ Rust يمنحه ميزة أداء حقيقية: زمن استجابة P50 يبلغ 8ms، وP95 أقل من 5ms، وحوالي 3,000 RPS على مثيل واحد بذاكرة 64MB فقط.

أمر ينبغي أن تعرفه قبل الالتزام به: استحوذت Mintlify على Helicone في مارس 2026، وانتقل الفريق إلى سان فرانسيسكو للعمل على منتج التوثيق وسياق الوكلاء لدى Mintlify. إعلان Helicone نفسه صريح بشأن ما يعنيه ذلك: تبقى المنصة عاملةً وتواصل إصدار تصحيحات أمنية وإصلاحات للعلل ودعماً للنماذج الجديدة، لكن لا توجد خارطة طريق لميزات جديدة بعد ذلك. إن كنت تحتاج بوابةً ما زالت تضيف ميزات فعلياً، فزِن هذا الأمر قبل أن تعتمدها معياراً لديك.

python
# Helicone: proxy بسطر واحد -- فقط غيّر عنوان URL الأساسي
from openai import OpenAI

client = OpenAI(
    base_url="https://oai.helicone.ai/v1",  # أو عنوان URL الذاتي الاستضافة
    api_key="sk-...",
    default_headers={
        "Helicone-Auth": "Bearer hlc-..."
    }
)

# جميع الطلبات الآن مُسجَّلة ومتتبَّعة وتُوجَّه عبر Helicone
response = client.chat.completions.create(
    model="gpt-4o",
    messages=[{"role": "user", "content": "حلّل هذا الكود"}]
)

ما هو رائع:

  • مبني على Rust: ~64MB ذاكرة، زمن استجابة P95 أقل من 5ms، 3,000 RPS لكل مثيل
  • موازنة حمل واعية بالصحة، تُوجّه إلى أسرع مزوّد متاح
  • لوحات بيانات فورية للتكاليف وزمن الاستجابة واستخدام الرموز ومعدلات الأخطاء
  • تكامل بسطر واحد, فقط غيّر عنوان URL الأساسي
  • نشر ثنائي واحد (Docker, K8s, bare metal)

ما هو أقل جودة:

  • في وضع الصيانة منذ استحواذ Mintlify (مارس 2026): تصحيحات أمنية وإصلاحات علل فقط، بلا ميزات جديدة أو خارطة طريق
  • ميزات المراقبة هي النجم؛ التوجيه أقل تطوراً من LiteLLM
  • عدد أقل من المزودين المدعومين مقارنةً بـ LiteLLM أو OpenRouter
  • مجتمع أصغر من LiteLLM (6K مقابل 54K نجوم GitHub)
  • الميزات المتقدمة (الخصائص المخصصة، والجلسات) تتطلب المنصة المُدارة

التسعير: مفتوح المصدر ومجاني للاستضافة الذاتية. المنصة المُدارة: مستوى Hobby مجاني (10,000 طلب/شهر، 1GB تخزين، احتفاظ 7 أيام، مقعد واحد). Pro بسعر $79/شهر (مقاعد غير محدودة، احتفاظ شهر واحد، تنبيهات، تقارير، HQL). Team بسعر $799/شهر (احتفاظ 3 أشهر، SOC 2، HIPAA، قناة Slack مخصصة). Enterprise مخصص (استضافة محلية، SAML SSO، خصومات على الكميات).

إذا كنت تُقيّم أدوات المراقبة بشكل أوسع، فإن ترتيبنا لـ أفضل منصات مراقبة الذكاء الاصطناعي يشمل Helicone جنباً إلى جنب مع Langfuse وArize وغيرها.

الحكم: Helicone لا يزال أفضل بوابة للفرق التي مشكلتها الأساسية هي "لا نستطيع رؤية ما يحدث مع استدعاءات LLM"، والمنتج القائم ليس ذاهباً إلى أي مكان. فقط ادخل وأنت تعلم أنك تتبنّى أداةً في وضع الصيانة: مناسبة تماماً للمراقبة اليوم، وأكثر خطورةً إن كنت تراهن على وصول ميزات بوابة جديدة العام المقبل.

7. Bifrost, الأفضل للأداء الخام

نجوم GitHub: ~6.6K | اللغة: Go | الترخيص: Apache 2.0

Bifrost هو بطل الأداء. مبني بـ Go من قِبل Maxim AI، يدّعي أداءً أسرع بـ 50 مرة من LiteLLM مع 11 ميكروثانية فقط من العبء لكل طلب عند 5,000 RPS. هذه ليست أرقاماً نظرية, مستخرجة من اختبارات تحميل مستمرة قابلة للإعادة. وقد ضاعف المشروع نجومه على GitHub أكثر من ثلاث مرات منذ آخر مراجعة لنا، من نحو 2,000 إلى 6,600، والنمو يواكب دفعةً حقيقيةً في الميزات: أطلق Bifrost بوابة MCP خاصة به مزوّدة بـ"Code Mode" لحوكمة كيفية استدعاء الوكلاء للأدوات الخارجية، وهي فئة الميزات نفسها التي كانت حكراً على TrueFoundry وPortkey.

الاختلاف المعماري جوهري: goroutines في Go تتعامل مع آلاف الاتصالات المتزامنة دون اختناق GIL في Python، والثنائي المُجمَّع يُزيل عبء المترجم تماماً.

yaml
# bifrost.yaml
account:
  provider: openai
  api_key: ${OPENAI_API_KEY}

models:
  - name: gpt-4o
    provider: openai
  - name: claude-sonnet-4-20250514
    provider: anthropic

routing:
  strategy: round-robin
  fallback: true

ما هو رائع:

  • عبء 11µs عند 5,000 RPS, الأدنى بين جميع البوابات في هذه القائمة
  • ثنائي Go: لا اعتماديات وقت تشغيل، بصمة ذاكرة صغيرة
  • موازنة حمل تكيفية عبر المزودين
  • وضع الكتلة للتوسع الأفقي
  • دعم 1,000+ نموذج
  • MCP Gateway مع Code Mode مدمج في المستوى المجاني مفتوح المصدر، إضافةً إلى إدارة الميزانيات عبر المفاتيح الافتراضية، والتخزين المؤقت الدلالي، والمراقبة الأصلية عبر OpenTelemetry، كلها مشمولة وليست محجوزة خلف المستوى المؤسسي

ما هو أقل جودة:

  • مشروع أحدث، مجتمع أصغر من LiteLLM (6.6K مقابل 54K نجوم GitHub) وتكاملات خارجية أقل
  • ضمانات سلامة المحتوى (تصفية PII، كشف التحايل) تتطلب المستوى المؤسسي؛ بينما يقدّم Portkey ضمانات مماثلة في بوابته المجانية مفتوحة المصدر
  • مبني من Maxim AI (بائع), الاتجاه المستقبلي مرتبط بخارطة طريقهم
  • وثائق أرق من وثائق LiteLLM الشاملة
  • تسجيل الدخول الموحّد (SAML/OIDC) والتحكم في الوصول المبني على الأدوار متاحان في المستوى المؤسسي فقط، فتحصل الفرق الصغيرة على الأداء دون ضوابط الوصول

التسعير: البوابة مفتوحة المصدر مجانية إلى الأبد (Apache 2.0)، وتغطي التوجيه والتحويل الاحتياطي وMCP Gateway والتخزين المؤقت الدلالي وإدارة الميزانيات بالمفاتيح الافتراضية. Enterprise بتسعير مخصص (احجز عرضاً توضيحياً) ويضيف الضمانات، ووضع الكتلة، وSSO عبر SAML/OIDC، وRBAC، وسجلات التدقيق، ودعماً مدعوماً باتفاقية مستوى خدمة؛ وتتوفر تجربة مجانية لمدة 14 يوماً.

الحكم: Bifrost للفرق التي تشغّل أنظمة إنتاج عالية الإنتاجية حيث يهم عبء البوابة، وقد صار أحد أقوى بدائل Portkey بعد أن أصبح مستواه المجاني يشمل حوكمة MCP وضوابط الميزانية التي كانت تتطلب منصةً مدفوعةً في أماكن أخرى. إذا كنت تعالج آلاف استدعاءات LLM في الثانية وتريد البقاء على بنية تحتية مفتوحة المصدر بلا استحواذ يلوح فوق خارطة الطريق، فإن معمارية Go في Bifrost تُحقق النتائج. لمعظم الفرق، عبء 8ms في LiteLLM مقبول تماماً، وإن كنت تحتاج ضمانات سلامة المحتوى المدمجة اليوم بدل انتظار المستوى المؤسسي، فبوابة Portkey مفتوحة المصدر لا تزال متقدمةً، وهذه المفاضلة هي جوهر القصة في المقارنة أدناه.

8. Cloudflare AI Gateway, أفضل خيار بلا بنية تحتية

النوع: خدمة مُدارة | الترخيص: مملوك (Cloudflare)

يدفع Cloudflare AI Gateway نهج "أنت لا تُدير شيئاً" إلى أقصاه. إذا كنت بالفعل على Cloudflare (وكثير من الفرق كذلك)، يمكنك تفعيل AI Gateway من لوحة التحكم والبدء في توجيه استدعاءات LLM عبر شبكة حافة Cloudflare دون بنية تحتية إضافية.

javascript
// فقط أضف بادئة URL مزوّدك بنقطة نهاية بوابة Cloudflare
const response = await fetch(
  "https://gateway.ai.cloudflare.com/v1/{account_id}/{gateway_name}/openai/chat/completions",
  {
    method: "POST",
    headers: {
      "Authorization": "Bearer sk-...",
      "Content-Type": "application/json"
    },
    body: JSON.stringify({
      model: "gpt-4o",
      messages: [{ role: "user", content: "مرحباً" }]
    })
  }
);

ما هو رائع:

  • مستوى مجاني بـ 100,000 سجل/شهر, كافٍ لمعظم المشاريع الجانبية
  • بنية تحتية صفرية: التفعيل من لوحة تحكم Cloudflare
  • تخزين مؤقت مدمج في الحافة (يقلل التكاليف وزمن الاستجابة)
  • تحديد المعدل والتحليلات مضمّنة
  • فوترة موحّدة: دفع تكاليف مزوّد LLM عبر Cloudflare
  • شبكة الحافة العالمية تقلل زمن الاستجابة للمستخدمين المنتشرين جغرافياً

ما هو أقل جودة:

  • مرتبط بإحكام بنظام Cloudflare, تكاليف التبديل حقيقية
  • ذكاء توجيه محدود مقارنةً بالبوابات المخصصة
  • حد 100,000 سجل في المستوى المجاني؛ اشتراك Workers Paid لمليون
  • عدد أقل من المزودين المدعومين مقارنةً بـ LiteLLM أو OpenRouter
  • لا خيار استضافة ذاتية

التسعير: مجاني (100,000 سجل/شهر)، اشتراك Workers Paid لمليون سجل. لا رسوم بوابة لكل طلب. ما زلت تدفع لمزودي LLM بشكل منفصل.

للفرق التي تُوجّه استدعاءات الدوال عبر المزودين، يمكن للتخزين المؤقت في الحافة لدى Cloudflare أن يقلل زمن الاستجابة بشكل ملموس لأنماط استخدام الأدوات المتكررة.

الحكم: Cloudflare AI Gateway هو الخيار الأفضل إذا كنت بالفعل على Cloudflare وتريد ميزات البوابة دون نشر أي شيء جديد. المستوى المجاني سخيّ للمشاريع الصغيرة. للاستخدام الجاد في الإنتاج، توفر البوابات المخصصة مزيداً من التحكم.

9. Kong AI Gateway, الأفضل لفرق إدارة API

نجوم GitHub: ~44K (Kong Gateway إجمالاً) | اللغة: Lua/OpenResty | الترخيص: Apache 2.0 (مجتمع)

Kong AI Gateway ليس منتجاً مستقلاً, إنه امتداد لـ API Gateway المُختبَر في المعارك من Kong، يضيف قدرات خاصة بـ LLM. إذا كانت مؤسستك تشغّل Kong بالفعل لإدارة API، فإن إضافة توجيه الذكاء الاصطناعي تثبيت إضافة، وليس منصة جديدة.

yaml
# إعداد Kong التصريحي (deck)
services:
  - name: ai-llm-service
    url: https://api.openai.com
    plugins:
      - name: ai-proxy
        config:
          route_type: llm/v1/chat
          model:
            provider: openai
            name: gpt-4o
      - name: ai-rate-limiting-advanced
        config:
          limit: [10000]
          window_size: [60]
          window_type: fixed
          strategy: local
          limit_by: consumer

ما هو رائع:

  • مبني على منصة إدارة API الناضجة لـ Kong (تستخدمها آلاف المؤسسات)
  • توجيه دلالي: يُوجّه الطلبات بناءً على محتوى/نية الطلب
  • تحديد معدل مبني على الرموز (ليس الطلبات فقط)
  • نظام بيئي للإضافات: المصادقة، وتحديد المعدل، والتحويلات تعمل جميعها مع مسارات الذكاء الاصطناعي
  • مقاييس OpenTelemetry + Prometheus لتكامل Datadog/Grafana

ما هو أقل جودة:

  • مُبالَغ فيه إذا لم تكن تستخدم Kong بالفعل, منحنى تعلم حاد
  • ميزات الذكاء الاصطناعي المؤسسية تتطلب ترخيص Kong Enterprise (مدفوع)
  • تعقيد الإعداد أعلى من أي بوابة أخرى في هذه القائمة
  • يتطلب معرفة بنية Kong التحتية (أو أن يتعلمها الفريق)
  • الميزات الخاصة بالذكاء الاصطناعي أحدث وأقل نضجاً من نواة Kong

التسعير: إصدار المجتمع مجاني (مفتوح المصدر). ميزات الذكاء الاصطناعي المؤسسية تتطلب اشتراك Kong Enterprise (تسعير مخصص).

الحكم: Kong AI Gateway منطقي فقط إذا كانت مؤسستك تشغّل Kong بالفعل. إضافة توجيه LLM إلى طبقة إدارة API الموجودة لديك أذكى من نشر بوابة منفصلة. لكن لا تتبنّ Kong فقط من أجل توجيه LLM, هذا كشراء جرار لقص العشب.

10. TensorZero, الأفضل للتوجيه المُحسَّن بالتعلم الآلي (متوقف الآن)

نجوم GitHub: ~11.7K | اللغة: Rust | الترخيص: Apache 2.0 (مؤرشف، غير مُصان)

تحديث: أُوقف TensorZero في يونيو 2026. أرشف المشرفون المستودع في 12 يونيو 2026، وأوقفوا التطوير النشط، وأعادوا رأس المال الاستثماري المتبقي إلى المستثمرين بعد أن خلصوا إلى تعذّر إيجاد ملاءمة بين المنتج والسوق لمشروع مفتوح المصدر ومنتج تجاري في آنٍ واحد. نُبقي هذا المدخل في مكانه لأن الأفكار لا تزال تستحق الفهم ولأن الكود ما زال قابلاً للاشتقاق تحت Apache 2.0، لكن لا تتبنّه لنظام إنتاج جديد, لن تكون هناك تصحيحات أمنية، ولا تحديثات لواجهات المزودين، ولا دعم إن تعطّل شيء.

كان TensorZero أكثر البوابات رأياً في هذه القائمة. بينما تركز الأخرى على التوجيه والمراقبة، بنى TensorZero حلقة تحسين: كان يجمع بيانات الاستدلال، ويشغّل تقييمات، ويستخدم النتائج لتحسين قرارات التوجيه بمرور الوقت. فكّر فيها كبوابة تتعلم أي نموذج يعمل بشكل أفضل لأي نوع من الطلبات.

يوفر تطبيق Rust زمن استجابة P99 دون الميلي ثانية, حتى عند أكثر من 10,000 QPS. هذه ليست خطأ إملائي. حيث يضيف LiteLLM ~8ms وBifrost ~11µs، يدّعي TensorZero أقل من 1ms P99 تحت الحمل الشديد.

python
# TensorZero: استدلال منظّم مع التحسين
from tensorzero import TensorZeroGateway

with TensorZeroGateway("http://localhost:3000") as client:
    response = client.inference(
        function_name="generate_summary",
        input={
            "messages": [
                {"role": "user", "content": "لخّص هذه المقالة..."}
            ]
        }
    )

    # لاحقاً: أعد إرسال بيانات الجودة لتحسين التوجيه
    client.feedback(
        metric_name="summary_quality",
        inference_id=response.inference_id,
        value=0.92
    )

ما هو رائع:

  • زمن استجابة P99 أقل من 1ms عند 10,000+ QPS (أسرع أداء خام مع Rust)
  • حلقة تغذية راجعة: تتعلم أي النماذج تؤدي أفضل لكل دالة
  • استدلال منظّم مع التحقق من المخطط
  • اختبار A/B بين النماذج مدمج في البوابة
  • إطار تقييم مدمج

ما هو أقل جودة:

  • متوقف اعتباراً من يونيو 2026: المستودع مؤرشف وللقراءة فقط، بلا تحديثات مستقبلية أو تصحيحات أمنية أو دعم
  • منحنى تعلم أكثر حدةً من أي بوابة أخرى, تُعرّف "دوالاً"، وليس نماذج فقط
  • يتطلب إعادة التفكير في تكامل LLM حول مفهوم الدالة في TensorZero
  • أقل "جاهزية للتوصيل" من LiteLLM أو OpenRouter, ليس مجرد استبدال عنوان URL
  • الوثائق مُجمَّدة على حالتها الأخيرة ولم تعد تُحسَّن

التسعير: مجاني ومفتوح المصدر (Apache 2.0)، قابل للاشتقاق وللصيانة ذاتياً، لكن لا يوجد بائع تدفع له مقابل الدعم حتى لو أردت ذلك.

للفرق التي تشغّل بالفعل تقييمات LLM، كانت حلقة التغذية الراجعة في TensorZero وسيلةً مفيدةً فعلاً لسدّ الفجوة بين التقييم والتوجيه, فدرجات التقييم كانت تُحسّن مباشرةً أي النماذج يتم توجيهها. وتلك الفكرة تستحق التكرار حتى لو اختفت الأداة نفسها.

الحكم: كان TensorZero موجَّهاً للفرق الهندسية في التعلم الآلي التي أرادت من بوابتها أن تصبح أذكى بمرور الوقت، وكانت حلقة التحسين مبتكرةً حقاً. ومع توقف المشروع، لا يمكننا التوصية به لأي شيء جديد, اختر LiteLLM أو Bifrost أو Portkey بدلاً منه وابنِ تغذيةً راجعةً للتقييم داخل خط أنابيبك الخاص. وإن كنت تشغّل TensorZero بالفعل في الإنتاج، فالكود ما زال يعمل، لكن خصّص وقتاً للانتقال عنه قبل أن تصطدم بتغيير في واجهة أحد المزودين لا يستطيع التعامل معه.

عبء زمن الاستجابة لبوابات LLM: الأرقام الحقيقية

كل بوابة تضيف بعض العبء على استدعاءات LLM الخاصة بك. السؤال هو ما إذا كان ذلك مهماً لحالة الاستخدام لديك. إليك مقارنة البوابات في اختبارنا:

البوابةاللغةعبء زمن P50عبء زمن P95الإنتاجية (مثيل واحد)
BifrostGo~8µs~11µs5,000+ RPS
TensorZero‡Rust~0.3msأقل من 1ms10,000+ QPS
HeliconeRust~5ms~8ms~3,000 RPS
TrueFoundryاستضافة ذاتية~3ms†أقل من 3ms†10B+/شهر (بائع)
LiteLLMPython~4ms~8ms~1,000 RPS
PortkeyTypeScript~5ms~12ms~2,000 RPS
OpenRouterمُدار~15–30ms~50msغير متاح (مُدار)
Merge Gatewayمُدارغير مُختبَر بشكل مستقل§غير مُختبَر بشكل مستقل§غير متاح (مُدار)
Cloudflare AI GWمُدار~10–20ms~40msغير متاح (مُدار)
Kong AI GatewayLua/Go~3ms~8ms~3,000 RPS

† رقم TrueFoundry الأقل من 3ms مُبلَّغ عنه من البائع؛ لم نُجرِ عليه نفس اختبار التحميل المستقل الذي أجريناه على البوابات مفتوحة المصدر ذاتية الاستضافة.

‡ أُرشف مشروع TensorZero في يونيو 2026 (انظر المدخل أعلاه)؛ وأرقام زمن الاستجابة الخاصة به تاريخية ولم تعد قابلة للتحقق المستقل مقابل نسخة مُصانة بنشاط.

§ أُطلقت Merge Gateway بعد إجراء اختبار التحميل الذي أجريناه، لذا لم نقسها بالمنهجية نفسها التي استخدمناها مع البوابات الأخرى، ولن ننشر رقماً لم نقسه فعلياً. توقَّع أن يكون عبء البوابات المُدارة في النطاق نفسه الذي تسجله OpenRouter وCloudflare (نحو 10-30ms عند P50) إلى أن نختبرها.

السياق مهم. استدعاء GPT-4o النموذجي يستغرق 500–3,000ms بحسب طول المخرجات. حتى عبء 8ms في LiteLLM أقل من 1% من إجمالي زمن الاستجابة. السيناريو الوحيد الذي يهم فيه عبء البوابة هو أحمال العمل عالية التردد ومنخفضة زمن الاستجابة كالتصنيف الفوري أو توليد التضمينات على نطاق واسع. بالنسبة للذكاء الاصطناعي الحواري أو توليد المحتوى، أي بوابة في هذه القائمة سريعة بما يكفي.

البوابات المُدارة (OpenRouter, Cloudflare وMerge Gateway) تضيف عبئاً أكبر لأن طلبك يسافر إلى خوادمهم قبل الوصول إلى المزوّد. البوابات ذاتية الاستضافة تعمل بجانب تطبيقك، لذا القفزة الإضافية محلية.

Bifrost مقابل Portkey: أي بوابة LLM مفتوحة المصدر ينبغي أن تختار؟

إن كانت عبارة "بوابة LLM مفتوحة المصدر" هي ما بحثت عنه حرفياً، فإليك الحالة الصادقة لهذه الفئة في منتصف 2026: خمس من الأدوات التسع في هذا الترتيب تُصدَر كبرمجيات مفتوحة المصدر يمكنك استضافتها ذاتياً اليوم. LiteLLM (MIT) وBifrost (Apache 2.0) مفتوحان بالكامل بلا ميزات أساسية خلف جدار دفع. وبوابة Portkey تحت Apache 2.0 منذ مارس 2026، وإن كانت المنصة المُدارة المحيطة بها مملوكة. وHelicone (Apache 2.0) مفتوح المصدر لكنه في وضع الصيانة بعد استحواذ Mintlify عليه. وبوابة Kong الأساسية مفتوحة المصدر، لكن إضافات الذكاء الاصطناعي التي تهم توجيه LLM تقع خلف Kong Enterprise. وكان TensorZero مفتوح المصدر أيضاً، لكن المشروع متوقف، فلم نعد نعدّه خياراً حياً. أما TrueFoundry، التي غطيناها أعلاه، فتسلك طريقاً مختلفاً: نشر ذاتي الاستضافة للوحة تحكم مملوكة، لا قاعدة كود مفتوحة المصدر.

هكذا يبقى Bifrost وPortkey الخيارَين مفتوحَي المصدر الأكثر بحثاً، وقد ابتعد كلٌّ منهما عن الآخر منذ مراجعتنا السابقة. إليك كيف يتقارنان فعلاً:

البُعدBifrostPortkey
الجهة الداعمةMaxim AI (مستقلة)Palo Alto Networks (استحوذت في مايو 2026)
ترخيص البوابة الأساسيةApache 2.0، مفتوحة المصدر بالكاملApache 2.0 (البوابة فقط؛ المنصة مملوكة)
اللغةGoTypeScript/Node.js
عبء زمن الاستجابة P95~11µs~12ms
نجوم GitHub~6.6K~12K
ضمانات سلامة المحتوى (PII، كشف التحايل)المستوى المؤسسي فقطمشمولة في البوابة المجانية مفتوحة المصدر
حوكمة MCP وأدوات الوكلاءMCP Gateway مع Code Mode، مشمول في النسخة مفتوحة المصدرليست ميزةً رئيسية
SSO / RBACالمستوى المؤسسي فقطمستوى Production ($49/شهر) فما فوق
استقلالية خارطة الطريقبائع مستقلجزء من Prisma AIRS الآن

إن كنت تبحث عن "بديل لـ Bifrost" لأنك تريد ضمانات إنتاج دون دفع تكلفة Bifrost Enterprise، فإن بوابة Portkey المجانية مفتوحة المصدر تقدّم تنقيح PII وكشف التحايل جاهزَين من الصندوق، وهذه أكبر فجوة وظيفية بين الاثنين. وLiteLLM هو الوجهة الشائعة الأخرى، إذ يقايض سرعة Bifrost الخام بأوسع قائمة مزودين وأكبر مجتمع.

إن كنت تبحث عن "بدائل لـ Portkey" لأن استحواذ Palo Alto Networks يغيّر حساباتك للمخاطر (وهو تحفّظ معقول تماماً إن احتجت أن تبقى خارطة طريق بنيتك التحتية مستقلة عن أولويات شركة أمن سيبراني)، فأفضل خياراتك بالترتيب هي: Bifrost، إن كانت الإنتاجية الخام وحوكمة MCP أهم من الضمانات الجاهزة؛ وLiteLLM، إن أردت أكبر نظام بيئي ولم تمانع ملف زمن الاستجابة في Python؛ وTrueFoundry (المذكورة أعلاه)، إن كنت تحتاج تحديداً امتثال SOC 2/HIPAA/GDPR مع بائع غير Portkey. وHelicone مفتوح المصدر أيضاً، لكن وضع الصيانة يجعله أنسب للمراقبة منه لبوابة تتوقع أن تستمر في التطور.

لا أحد من Bifrost أو Portkey "أفضل" موضوعياً، فالأمر يتوقف على ما إذا كنت تريد ضمانات اليوم أم حوكمةً وسرعةً مع قدر أكبر قليلاً من الإعداد.

كيف تختار بوابة LLM الصحيحة

تجاوز مصفوفات الميزات. إليك القرار في جدول واحد:

إذا احتجت إلى...اخترالسبب
أقصى مرونة + استضافة ذاتيةLiteLLM100+ مزوّد، أكبر مجتمع، أكثر تكاملات
توجيه على نطاق المؤسسات + التحكم في الإنفاقMerge Gatewayسياسات توجيه حسب العميل أو الميزة، حدود إنفاق، إسناد التكلفة على مستوى الطلب
حوكمة مؤسسية + سيادة البياناتTrueFoundryيعمل في VPC الخاص بك، SOC 2/HIPAA/GDPR، MCP Gateway لأدوات الوكلاء
وصول متعدد النماذج سريع، بلا عملياتOpenRouterسجّل واستدعِ 300+ نموذج
ضمانات إنتاج + امتثالPortkeyتنقيح PII، كشف التحايل، مسارات التدقيق (وهي الآن جزء من Prisma AIRS لدى Palo Alto Networks)
المراقبة كأولويةHeliconeأفضل رصد، أداء Rust، إعداد بسطر واحد (في وضع الصيانة منذ مارس 2026)
أقل زمن استجابة ممكن + حوكمة MCP في المصدر المفتوحBifrostعبء 11µs في Go، وضع الكتلة، MCP Gateway مشمول في المستوى المجاني
بالفعل على CloudflareCloudflare AI GWمجاني، تخزين مؤقت في الحافة، بنية تحتية صفرية
بالفعل يستخدم KongKong AI GWإضافة توجيه LLM إلى إدارة API الحالية
تحسين توجيه مبني على التعلم الآليTensorZeroمتوقف منذ يونيو 2026، الكود قابل للاشتقاق لكنه لم يعد خياراً آمناً لمشاريع جديدة

ملاحظة حول الاستضافة الذاتية مقابل المُدارة: البوابات ذاتية الاستضافة (LiteLLM, Helicone, Bifrost) تمنحك تحكماً كاملاً في تدفق البيانات, لا شيء يغادر بنيتك التحتية إلا استدعاء API اللـ LLM الفعلي. هذا مهم للرعاية الصحية والمالية وأي سياق تكون فيه إقامة البيانات متطلباً صارماً. البوابات المُدارة (OpenRouter, Cloudflare وMerge Gateway) تتبادل ذلك التحكم مقابل حمل تشغيلي صفري. Portkey وKong في المنتصف, بوابات مفتوحة المصدر مع منصات مُدارة اختيارية. بعض الفرق التي تُعطي الأولوية لسيادة البيانات تجمع أحياناً بين بوابة ذاتية الاستضافة ونماذج LLM التي تعمل محلياً حتى لا تغادر أي طلبات شبكتها.

لمعظم الفرق، يتلخص القرار في سؤالين:

  1. هل تريد الاستضافة الذاتية؟ نعم -> LiteLLM. لا -> OpenRouter للنماذج الأولية، وMerge Gateway عند الانتقال إلى الإنتاج.
  2. هل تحتاج ضمانات؟ نعم -> Portkey. لا -> ابقَ مع no. 1.

إذا كنت تبني تطبيقات RAG تستدعي مزودين متعددين للتضمينات والاكتمالات، فإن البوابة ضرورية عملياً. الأمر نفسه ينطبق على التطبيقات التي تحتاج مخرجات منظّمة عبر مزودين مختلفين, البوابات تُوحّد تنسيق الاستجابة حتى لا تنكسر منطق التحليل عند تبديل النماذج.

اختيار الأداة هو الجزء السهل. أما تشغيلها بموثوقية داخل منتج حقيقي فهو ما تتعثر عنده معظم الفرق، وهذا بالضبط ما يبنيه فريق تكامل الذكاء الاصطناعي لدينا لعملائنا، من خطوط RAG إلى الوكلاء المخصصين. هل تريدون رأياً ثانياً في بنيتكم التقنية؟ احصلوا على استشارة مجانية.

الأسئلة الشائعة

ما الفرق بين بوابة LLM والـ proxy والـ router؟

الـ proxy يُعيد توجيه الطلبات ويضيف التسجيل. الـ router يختار أفضل نموذج/مزوّد لكل طلب. البوابة تجمع كليهما مع تتبع التكاليف والتخزين المؤقت والضمانات والمراقبة. عملياً، معظم أدوات "البوابة" تؤدي الثلاثة, المصطلحات تُستخدم بالتبادل.

هل LiteLLM مجاني فعلاً؟

الـ proxy مفتوح المصدر مجاني تماماً (ترخيص MIT). تدفع لاستضافتك الخاصة (VPS بـ $5/شهر يعمل للاستخدام الخفيف) وتكاليف API مزوّد LLM. BerriAI تقدم خطط مؤسسية للفرق التي تريد استضافة مُدارة، وSSO، ودعماً.

هل يضيف OpenRouter زمن استجابة ملحوظاً؟

ضئيل. OpenRouter يضيف عبء توجيه صغير (عادةً أقل من 50ms) بالإضافة إلى أي مسافة جغرافية بينك وبين خوادمهم. لمعظم التطبيقات، الفرق لا يُذكر. لأنظمة حرجة لزمن الاستجابة تعالج آلاف الطلبات في الثانية، يكون خيار ذاتي الاستضافة مثل Bifrost أفضل.

هل يمكنني استخدام بوابات متعددة معاً؟

نعم، وبعض الفرق يفعل ذلك. نمط شائع هو استخدام OpenRouter للنمذجة الأولية السريعة والانتقال إلى LiteLLM للإنتاج. أو استخدام Helicone كطبقة مراقبة أمام توجيه LiteLLM. كن حذراً فقط من تراكم زمن الاستجابة.

أي بوابة لديها أفضل تخزين مؤقت؟

Portkey وCloudflare AI Gateway لديهما أكثر تطبيقات التخزين المؤقت نضجاً. Portkey يقدم تخزيناً مؤقتاً دلالياً (مطابقة تقريبية للطلبات المتشابهة)، بينما يستغل Cloudflare شبكة الحافة العالمية للتخزين المؤقت الجغرافي. LiteLLM يدعم التخزين المؤقت المبني على Redis. لنظرة أعمق على استراتيجيات التخزين المؤقت، اطّلع على دليلنا لتخزين طلبات LLM مؤقتاً.

هل أحتاج بوابة إذا كنت أستخدم مزوّد LLM واحداً فقط؟

على الأرجح لا للتوجيه. لكن ربما ما زلت تريد واحدة للمراقبة (Helicone)، أو تتبع التكاليف (LiteLLM)، أو الضمانات (Portkey). ميزات تتبع التكاليف والتسجيل وحدها يمكن أن تبرر بوابة حتى مع مزوّد واحد.

كيف تتعامل البوابات مع الاستجابات المتدفقة؟

جميع البوابات في هذه القائمة تدعم بث server-sent events (SSE). البوابة تُعيد توجيه التدفق من المزوّد إلى عميلك بتخزين مؤقت أدنى. تأثير زمن الاستجابة على البث عادةً أقل من الطلبات غير المتدفقة لأن العبء لكل اتصال، وليس لكل رمز.

ماذا يحدث عند تعطل أحد المزودين؟

معظم البوابات تدعم سلاسل التراجع. تضبط مزوّداً أساسياً وواحداً أو أكثر من البدائل. إذا أعاد الأساسي أخطاء أو تجاوز عتبات زمن الاستجابة، توجّه البوابة تلقائياً إلى المزوّد التالي. LiteLLM وPortkey وHelicone جميعها تتعامل مع هذا جيداً. OpenRouter يفعل ذلك تلقائياً خلف الكواليس.

هل يمكن للبوابات تطبيق حدود التكاليف؟

نعم. LiteLLM لديه ضوابط ميزانية مدمجة لكل فريق أو مستخدم أو مفتاح API. Portkey يتتبع الإنفاق في الوقت الفعلي مع تنبيهات. Kong يدعم حصصاً مبنية على الرموز. Cloudflare يوفر تحليلات الاستخدام. هذا في الواقع أحد أقوى الحجج لاستخدام بوابة, بدونها، يمكن لحلقة واحدة منفلتة أن تحرق ميزانية API في ليلة واحدة.

أي بوابة الأفضل للشركات الناشئة مقابل المؤسسات؟

الشركات الناشئة: OpenRouter (إعداد صفري) أو LiteLLM (مجاني، مرن). المؤسسات: TrueFoundry (سيادة البيانات، SOC 2/HIPAA/GDPR، تحكم في حركة مرور النماذج والوكلاء عبر MCP Gateway)، أو Portkey (ضمانات، امتثال، مسارات تدقيق)، أو Kong AI Gateway (إذا كان Kong مستخدماً بالفعل). المميزات المؤسسية الرئيسية هي SSO، والتحكم في الوصول المبني على الأدوار، وضوابط إقامة البيانات، وتسجيل التدقيق, ميزات الشركات الناشئة لا تحتاجها بعد لكن المؤسسات لا يمكنها تخطيها.

ما أفضل LLM proxy؟

LiteLLM هو أفضل LLM proxy لمعظم الفرق. يعمل كحاوية Docker مستقلة، ويُغلّف 100+ مزوّد خلف نقطة نهاية متوافقة مع OpenAI، ومجاني تماماً للاستضافة الذاتية. إذا كان "proxy" يعني أنك تريد بنية تحتية صفرية، فإن OpenRouter يعمل كـ proxy سحابي يُدار مع 300+ نموذج على مفتاح API واحد. الفرق يكمن في التحكم: LiteLLM يحتفظ ببياناتك على خوادمك؛ OpenRouter يُوجّهها عبر منصته.

ما الفرق بين بوابة LLM وراوتر LLM؟

راوتر LLM يختار النموذج أو المزوّد الذي يتعامل مع طلب معين, عادةً بناءً على التكلفة أو زمن الاستجابة أو محتوى الطلب. بوابة LLM تفعل ذلك وأكثر: تضيف تتبع التكاليف والتخزين المؤقت والضمانات وتحديد المعدل والمراقبة فوق طبقة التوجيه. جميع الأدوات في هذه القائمة هي بوابات تقنياً. الراوترات الصرفة (أدوات تتخصص فقط في اختيار النموذج دون middleware آخر) نادرة في الإنتاج لأن الفرق تحتاج دائماً على الأقل إلى تسجيل جنباً إلى جنب مع التوجيه.

Portkey مقابل Bifrost: أيهما ينبغي أن أختار في 2026؟

اختر Bifrost إن كان زمن الاستجابة الخام وحوكمة أدوات الوكلاء عبر MCP هما الأهم لديك، فمعماريته المبنية على Go تضيف 11 ميكروثانية من العبء مقابل ~12ms لدى Portkey، كما صار المستوى المجاني مفتوح المصدر في Bifrost يشمل MCP Gateway مع Code Mode. واختر Portkey إن كنت تحتاج ضمانات سلامة المحتوى (تنقيح PII، كشف التحايل) عاملةً من الصندوق دون دفع تكلفة مستوى مؤسسي، لأن Bifrost يحجزها خلف خطته المدفوعة. والعامل الآخر: استحوذت Palo Alto Networks على Portkey في مايو 2026 وصار جزءاً من منصة Prisma AIRS الأمنية، بينما يبقى Bifrost مشروعاً مفتوح المصدر مستقلاً من Maxim AI. لا أحدهما أفضل بإطلاق، فالمفاضلة بين السرعة والاستقلالية من جهة والضمانات والجهة الداعمة من جهة أخرى.

ما أفضل بدائل Portkey الآن بعد أن أصبحت مملوكة لـ Palo Alto Networks؟

أقوى البدائل المستقلة هي Bifrost (الأسرع، وبات لديه MCP Gateway خاص به، وإن كانت الضمانات تتطلب المستوى المؤسسي)، وLiteLLM (أوسع تغطية للمزودين وأكبر مجتمع، إن لم تكن تحتاج ضمانات مدمجة)، وTrueFoundry (حوكمة مؤسسية وشهادات امتثال مماثلة، ولا تزال بائعاً مستقلاً). وHelicone مفتوح المصدر أيضاً، لكنه في وضع الصيانة منذ استحواذ Mintlify عليه في مارس 2026، فهو خيار أفضل للمراقبة منه كبديل بوابة تتطلع إلى المستقبل.

الوسوم

llm-gatewayllm-proxyllm-routerlitellmopenroutermerge-gatewayai-infrastructure

شارك هذا المقال

مقالات ذات صلة

المزيد في ai-machine-learning

ai-machine-learning
Aug 29, 2026

أفضل وكلاء الذكاء الاصطناعي لخدمة العملاء: 8 أدوات مصنفة حسب التسليم لا الضجيج

ثمانية وكلاء ذكاء اصطناعي لخدمة العملاء مصنفون حسب جودة التسليم، وحسب ما إذا كان الروبوت يستشهد بمقال المصدر. أسعار حية سُحبت في 17 أغسطس 2026 من الصفحات الرسمية، وتشمل Intercom Fin وZendesk AI وChatbase وWeav وWatermelon وHeyy وAda وChipp.

8 دقائق قراءة قراءة
اقرأ
ai-machine-learning
Aug 22, 2026

أفضل منشئي المواقع بالذكاء الاصطناعي: قارنا 8 وننشر 2

خطة Framer Basic بسعر 10$/شهر هي الخيار الافتراضي لموقع وكالة من صفحة واحدة بين أفضل منشئي المواقع بالذكاء الاصطناعي التي قيّمناها في 17 أغسطس 2026. وDurable أسرع وصولًا إلى رابط منشور. أما Webflow فهي الوجهة عندما تكون الحاجة تحكمًا بمستوى Designer.

8 دقائق قراءة قراءة
اقرأ
ابدأ مشروعك

هل أنت مستعد لبناء شيء استثنائي؟

دعنا نحول رؤيتك إلى واقع. فريقنا جاهز لمساعدتك في إنشاء برمجيات تصنع الفرق.