ai-machine-learning

Devin أم Claude Code أم Codex في 2026؟ اختبرنا 8 وكلاء برمجة

بقلم Techsy Editorial Team
تم التحديث May 12, 2026
20 قراءة
Devin أم Claude Code أم Codex في 2026؟ اختبرنا 8 وكلاء برمجة

8 وكلاء برمجة في الخلفية مقارنةً: الأسعار، المعايير، والاستخدام الأمثل (أبريل 2026)

وكلاء البرمجة في الخلفية انتقلوا من نماذج بحثية إلى سلعة متاحة في اثني عشر شهراً. Cognition خفّضت السعر الأدنى لـ Devin من 500 دولار إلى 20 دولاراً شهرياً في أبريل هذا العام، وأعاد OpenAI بناء نظام الفوترة في Codex في 2 أبريل، وأغلقت Factory جولة تمويل Series C بقيمة 150 مليون دولار قبل أسبوعين. اختبرنا الأدوات الثمانية في بيئة الإنتاج هذا الشهر على مشاريع Techsy الداخلية، والأرقام أدناه هي ما دفعناه فعلاً. لا نبيع أياً من هذه الأدوات ولا توجد روابط تابعة — كل نتيجة أخرى في صدر نتائج هذا البحث منشورة من قِبل بائع لأحد الوكلاء الواردين في القائمة.

الأداةالسعر الابتدائينموذج التشغيلبيئة معزولة / سحابيةتكامل GitHubالأنسب لـإحصاء رئيسي
Devin20$/شهر + 2.25$/ACUمجموعة CognitionVM كامل معزول (IDE + متصفح خاص)PR عبر تطبيق GHتفويض المهام المحددة كاملاً~5$ لكل مهمة إصلاح خطأ
Cursor BG Agents20$/شهر (Pro)نموذج حدودي حسب الاختيارVM سحابي مؤقتPR عبر التكاملمستخدمو Cursor الراغبون في العمل غير المتزامنحتى 8 وكلاء بالتوازي
Codex Cloud20$/شهر (Plus) → 200$ (Pro)OpenAI gpt-5-codexبيئة معزولة OpenAIPR عبر Codex CLI / الويبمستخدمو ChatGPT Pro77.3% في Terminal-Bench 2.0
Claude Code Remote20$/شهر (Pro) → 200$ (Max 20x)Claude Opus 4.7سحابة AnthropicPR عبر تطبيق GHمستخدمو Claude Code المتقدمون + المهام المجدولة87.6% في SWE-bench Verified
Copilot Coding Agent10$/شهر (Pro) → 39$ (Enterprise)GPT/Claude (مقيّد بالخطة)GitHub-managed runnerأصيل (issue → PR)فرق GH Enterprise/Businessأعمق تكامل مع GitHub في الفئة
Google Julesمجاني (15/يوم) → 19.99$+GeminiVM سحابي من GooglePR عبر التكاملالمطورون المستقلون / الفرق الصغيرةأفضل طبقة مجانية في الفئة
Factory Droids20$/شهر (مقعدان)توجيه متعدد النماذجسحابي + محليPR عبر التكاملالقطاعات المنظَّمةيُستخدم في NVIDIA وAdobe وBayer
إشارات جديرة بالذكرمتفاوتمتفاوتمتفاوتمتفاوتالمصادر المفتوحة / خطوط الأنابيب المخصصةOpenHands، Antigravity، Aider

الأسعار اعتباراً من 2026-04-26. الخطط القائمة على الرموز أو ACU تُضاف فوق السعر الأساسي. تحقق قبل الشراء — انظر روابط البائع في قسم كل أداة. للتوليد من الصفر بدلاً من العمل في مستودع قائم، راجع مقارنة lovable-vs-bolt-vs-v0.

ما هو وكيل البرمجة في الخلفية؟

وكيل البرمجة في الخلفية هو مهندس برمجيات بالذكاء الاصطناعي يعمل بشكل غير متزامن في بيئة سحابية معزولة. تعطيه مهمة — issue على GitHub أو تذكرة Linear أو رسالة Slack — ويعمل وحده دقائق أو ساعات، ثم يُعيد إليك طلب سحب للمراجعة. لا تراقبه وهو يكتب.

هذه هي السمة المميزة. الأدوات المدمجة مثل Cursor وCopilot تقترح الكود أثناء كتابتك؛ أما وكلاء الذكاء الاصطناعي في الخلفية فيضعون المهام في قائمة الانتظار، ينفذونها، ويُرسلون التقارير. دورة الحياة واحدة عبر كل أداة في هذه القائمة: تذكرة → بيئة معزولة سحابية → تعديل تلقائي → PR → مراجعة بشرية.

نشأت هذه الفئة لأن القدرات الوكيلية بعيدة الأفق نضجت في أواخر 2024 مع إطلاق Devin، وتراكمت عليها في 2025 كل من Codex Cloud وCursor Background Agents وJules. شُحنت Claude Code Remote Tasks في 20 مارس 2026، وبات نمط "اضبطها وانصرف" سائداً تماماً.

لماذا يهمنا هذا النمط؟ التوازي. يمكنك إدراج خمس تذاكر محددة بوضوح بعد الظهر يوم الجمعة والحصول على خمسة طلبات سحب جاهزة للمراجعة صباح الاثنين. هذا سير عمل مختلف تماماً عن البرمجة بالزوج مع نموذج ما — أقرب إلى إدارة مطوّر مبتدئ من الكتابة جنباً إلى جنب معه. يبحث الناس أيضاً عن "دعم وكيل الخلفية في claude code" تحديداً، وهذا سبب تناولنا لـ Claude Code Remote Tasks هنا لا لـ Devin وحده. تناولنا الجانب المدمج بشكل منفصل في مقارنة Claude Code وCursor وCopilot للأدوات المدمجة. وللاطلاع على شرح معماري على مستوى الفئة، يُعدّ دليل Tembo التمهيدي نقطة انطلاق جيدة.

وكلاء الخلفية مقابل الوكلاء المدمجة — متى يتفوق غير المتزامن على المتزامن؟

وكلاء الخلفية غير المتزامنة تكسب حين تستغرق المهمة أكثر من 15 دقيقة ولا تحتاج إلى تصحيح المسار في منتصف التنفيذ — إصلاحات الأخطاء المحددة، ترقيات التبعيات، إعادة الهيكلة المتكررة، الترحيل متعدد الملفات. الوكلاء المدمجون مثل Cursor وCopilot يكسبون حين تستكشف أو تبني نماذج أولية أو تبرمج بالزوج مع النموذج وتحتاج للتفاعل الفوري.

هذا هو الملخص. المصفوفة أدناه هي الطريقة التي نختار بها فعلاً في مشاريع Techsy:

استخدم غير المتزامن (الخلفية) حين…استخدم المدمج (Cursor/Copilot) حين…
المهمة محددة بوضوح (issue بمعايير قبول)تستكشف أو تبني نماذج أولية
العمل المتوقع > 15 دقيقةتحتاج تصحيح المسار في منتصف التنفيذ
تريد تشغيل 3+ مهام بالتوازيتريد جلسة مركّزة واحدة
تقبل مراجعة PR لاحقاًتريد رؤية الاقتراحات أثناء الكتابة
المهمة متكررة (تبعيات، ترحيل، تنسيق)المهمة جديدة وإبداعية

بشكل ملموس: "رُفِّعت 47 حزمة وأُصلحت التغييرات الكاسرة" هي مهمة وكلاء البرمجة غير المتزامنة بامتياز — محددة، آلية، قابلة للتوازي. "بنيت مسار لوحة تحكم جديدة" هي عمل مدمج — ستكرر على التخطيط والنص وحالات الحافة أثناء التطوير.

الانتقال بين المتزامن وغير المتزامن

معظم الفرق التي نعمل معها تُشغّل الاثنين معاً في النهاية. Cursor المدمج للكود الجديد، Cursor Background Agents للترقيات. Claude Code التفاعلي للعمل المعماري، Claude Code Remote Tasks لمهمة رفع التبعيات الأسبوعية المجدولة. الانتقال بينهما هو سير العمل ذاته — لا أداة تحل محل الأخرى. إذا كنت تبقى في محررك، تتناول مقارنة Windsurf وCursor الجانب المتزامن بالتفصيل.

إذا استغرقت المهمة أكثر من 15 دقيقة ولا تحتاج للمراقبة — فالخيار غير المتزامن يكسب.

Devin (Cognition) — قائد الاستقلالية

Devin هو أكثر وكلاء الخلفية استقلاليةً في السوق — تمنحه Cognition VM معزولاً كاملاً بـ IDE وخاصة ومتصفح وطرفية. انخفض السعر من حد أدنى 500 دولار شهرياً للمؤسسات إلى 20 دولاراً شهرياً + 2.25 دولار لكل وحدة حوسبة للوكيل (ACU) في أبريل 2026، مما جعله عنوان الشهر في مجال وكلاء البرمجة المستقلة.

التسعير. الأساسي 20$/شهر + 2.25$/ACU. فريق 500$/شهر مع 250 ACU مشمولة وACU إضافية بـ 2$ لكل وحدة. 1 ACU تعادل تقريباً 15 دقيقة عمل. إصلاح خطأ نموذجي يستهلك 2-3 ACU، أي 4.50-6.75 دولار. الترحيل متعدد الملفات قد يصل إلى 30+ ACU، أي 67.50 دولار فأكثر. (devin.ai/pricing، اعتباراً من 2026-04-26.)

نقاط القوة. أعلى استقلالية في القائمة. VM يشمل متصفحاً، فـ Devin يستطيع قراءة التوثيق وStack Overflow دون أن تُلقّمه السياق بنفسك. منتج ناضج — Cognition شحنت في مارس 2024 وأمضت سنتين في صقل الأوامر التي تجعل Devin مفيداً فعلاً.

نقاط الضعف. تكاليف ACU تصبح غير قابلة للتنبؤ في الأعمال الجديدة. تحكم أقل في منتصف المهمة مقارنةً بـ Codex أو Cursor — تضبط المهمة وتمضي، وهذا جيد حتى يُنفق Devin 8 ACU في تصحيح خطأ مطبعي. يحتاج إلى معايير قبول دقيقة؛ التذاكر المبهمة تنتج PRs مبهمة.

اختره إذا: أردت تفويض عناصر المتراكم المحددة بالكامل ويستطيع فريقك كتابة معايير قبول واضحة.

Cursor Background Agents

وكلاء Cursor في الخلفية تعمل بشكل غير متزامن داخل محرر Cursor — حتى 8 وكلاء بالتوازي، يمكن تشغيلها من Slack أو Linear أو GitHub أو من داخل المحرر. تستخدم النموذج الحدودي الذي تختاره، لذا تعتمد التكلفة على استهلاك الرموز لا على معدل ACU ثابت. Pro بـ 20 دولاراً شهرياً مع رصيد استخدام 20 دولاراً مشموله.

التسعير. Hobby 0$، Pro 20$/شهر (يشمل 20$ استخداماً)، Pro+ 60$/شهر (70$ استخدام)، Ultra 200$/شهر (400$ استخدام)، Teams 40$/مستخدم/شهر. وكلاء الخلفية تُفوتر استخداماً على الرموز — النموذج + طول السياق + طول المخرجات. (cursor.com/pricing، اعتباراً من 2026-04-26. ميزة Background Agents أُطلقت في Cursor 0.50.)

نقاط القوة. أوثق تكامل مع المحرر في القائمة — جلستك المدمجة ووكيل الخلفية وقواعدك كلها في أداة واحدة. حتى 8 وكلاء بالتوازي يعني توزيع إعادة الهيكلة عبر الوحدات والعودة للنتائج في دقائق. تشغيل من Slack وLinear وGitHub يجيب على سؤال "أي وكيل خلفية يعمل مع Linear وSlack" — Cursor يعمل، بشكل أصيل.

نقاط الضعف. استهلاك نموذج النهاية يستنفد رصيد 20 دولاراً المشمول أسرع مما تتوقع؛ جلسة Opus ثقيلة واحدة قد تستنزفه. التكلفة لكل مهمة غير واضحة ما لم تتحقق من لوحة الاستخدام، وهو ما لا تفعله معظم الفرق حتى يصل الفاتورة.

اختره إذا: كنت تعيش في Cursor وتريد العمل غير المتزامن دون تغيير الأدوات — وتقبل مراجعة لوحة الاستخدام مرة أسبوعياً. قواعد Cursor الخاصة بك تخدم كلاً من الجلسات المدمجة والجلسات في الخلفية، لذا تكلفة الإعداد قريبة من الصفر إذا كنت مستخدماً لـ Cursor مسبقاً.

Codex Cloud (OpenAI)

Codex Cloud هو وكيل البرمجة غير المتزامن من OpenAI. تصف مهمة، يُنشئ Codex VM معزولاً، يستنسخ مستودعك، ويُعيد PR. يتصدر Terminal-Bench 2.0 بنسبة 77.3%، يعمل بسرعة ~240 رمزاً/ثانية (نحو 2.5 أضعاف سرعة Opus)، وانتقل إلى الفوترة على الرموز في 2 أبريل 2026.

التسعير. مشمول في ChatGPT Plus (20$/شهر). طبقة Pro الجديدة 100$/شهر (5 أضعاف استخدام Plus؛ عرض ترويجي 2× = 10× حتى 31 مايو 2026). Pro 200$/شهر. فوترة على الرموز منذ 2026-04-02. Codex CLI مفتوح المصدر ومجاني مع مفتاحك الخاص. التكلفة الفعلية تصل إلى ~100-200$/مطوّر/شهر للمستخدمين النشطين. (developers.openai.com/codex/pricing، تغطية TechCrunch لطبقة Pro بـ 100 دولار، اعتباراً من 2026-04-26.)

نقاط القوة. بطل الإنتاجية بـ ~240 رمزاً/ثانية — للمهام الثقيلة في الرموز كترقيات التبعيات عبر ملفات كثيرة، ينهي Codex المهمة وClaude ما زال يفكر. CLI مفتوح المصدر ويعمل بمفتاح API الخاص بك، ما يسمح بتوصيل Codex في CI دون دفع ChatGPT Pro. التوزيع ضخم: كل مستخدم ChatGPT Plus لديه وصول إليه فعلاً.

نقاط الضعف. الفوترة على الرموز يصعب التنبؤ بها من مهمة لأخرى. إصلاح 2 أبريل يجعل المقارنات الأقدم خاطئة في الأسعار. CLI يبدو كمنتج منفصل عن Codex على الويب؛ التكامل غير محكم.

اختره إذا: كنت مستخدم ChatGPT Pro يريد وكيلاً سحابياً عميق التكامل — أو محباً للـ CLI يريد استخدام مفتاحه الخاص.

bash
# أرسل مهمة إلى Codex Cloud من CLI
codex task create \
  --repo "techsy-io/example-app" \
  --branch "main" \
  --prompt "Bump all dependencies to latest and fix breaking changes" \
  --watch

Claude Code Remote Tasks (Anthropic)

Claude Code Remote Tasks تتيح لك تحديد مستودع GitHub وأمر تشغيل وجدول زمني — يعمل Claude باستقلالية على سحابة Anthropic ويفتح PR عند الانتهاء. أُطلقت في 20 مارس 2026. مدعومة بـ Opus 4.7 بأعلى نسبة في الفئة: 87.6% على SWE-bench Verified و64.3% على SWE-bench Pro. هذا هو الجواب على الاستعلام المكتمل تلقائياً "دعم وكيل الخلفية في claude code" — منتج مشحون فعلياً.

التسعير. مشمول في خطط Claude Code Pro/Max. Pro 20$/شهر، Max 5x 100$/شهر، Max 20x 200$/شهر. المستخدمون الثقيلون يصلون إلى 100-200$/شهر فعلياً. (claude.com/code، platform.claude.com/docs/en/managed-agents/overview، اعتباراً من 2026-04-26.)

نقاط القوة. أعلى نتيجة SWE-bench Verified في القائمة (87.6%). جلسات وكيل ذات حالة مستمرة — تستطيع المهمة عن بُعد استكمال ما توقفت عنده بدلاً من البدء من الصفر في كل مرة. تتكامل مع hooks ومنظومة أدوات Claude Code القائمة، فالمهارات وأوامر الشرطة والوكلاء الفرعيون يعملون بنفس الطريقة في الجلسات التفاعلية.

نقاط الضعف. أحدث إضافة للقائمة — أنماط التكامل الموثقة أقل من Devin أو Codex، ونماذج مجتمعية أقل للنسخ منها. يعتمد على CLI بالأساس؛ لا واجهة رسومية، ما يرفع الحاجز أمام المطورين غير المعتادين على سطر الأوامر في الفريق.

اختره إذا: كنت مستخدماً متقدماً لـ Claude Code وتريد مهام متكررة مجدولة — تحديثات التبعيات الأسبوعية، إعادة الهيكلة على نمط cron، مرورات ضمان الجودة عند الطلب. يمكنك ربط hooks في Claude Code بالمهام عن بُعد بنفس الطريقة المستخدمة في الجلسات التفاعلية، وكانت Remote Tasks من الميزات المسرّبة ثم المشحونة التي تناولناها في مارس.

bash
# جدولة مهمة بعيدة متكررة في Claude Code
claude-code remote create \
  --repo "techsy-io/example-app" \
  --schedule "weekly" \
  --prompt "Bump deps, run tests, open PR if green"

Copilot Coding Agent (GitHub)

Copilot Coding Agent يحوّل issue على GitHub إلى طلب سحب — تعيّن الوكيل كما تعيّن زميلاً في الفريق. إنه أكثر سير عمل أصيل مع GitHub في هذه القائمة. ملاحظة: اعتباراً من 20 أبريل 2026 أوقف GitHub قبول اشتراكات Pro وPro+ الجديدة؛ المشتركون الحاليون وخطط Business/Enterprise غير متأثرين.

التسعير. Free 0$، Pro 10$/شهر، Pro+ 39$/شهر، Business 19$/مستخدم/شهر، Enterprise 39$/مستخدم/شهر. يعتمد على الطلبات المميزة: Free 50/شهر، Pro 300/شهر، Pro+ 1500/شهر، Enterprise 1000/مستخدم/شهر. تجميد الاشتراكات الجديدة لـ Pro/Pro+/الطلاب اعتباراً من 2026-04-20 — Business/Enterprise لا يزالان متاحَين. (github.com/features/copilot/plans، اعتباراً من 2026-04-26.)

نقاط القوة. أعمق تكامل مع GitHub في الفئة. تحويل issue إلى PR هو أكثر سير عمل أصيل — لا تطبيق إضافي، لا لوحة تحكم خارجية، الوكيل يظهر كمحيل في نفس الواجهة التي تستخدمها بالفعل. تحديث مراجعة الكود في مارس 2026 يمكنه إعادة توجيه تعليقات المراجعة إلى وكيل البرمجة تلقائياً، مما يُغلق الحلقة دون مغادرة GitHub.

نقاط الضعف. تحديد النماذج محدود في الطبقات الأدنى — لا يمكنك اختيار Opus على Pro مثلاً. رصيد الطلبات المميزة ينفد سريعاً على Pro بـ 300 طلب/شهر إذا كنت تشحن يومياً. تجميد الاشتراكات الجديدة يضيف احتكاكاً لمشتركين الأفراد الجدد.

اختره إذا: كان فريقك على GitHub Business أو Enterprise وتريد البرمجة غير المتزامنة بصفر إعداد. المقاعد الحالية تستطيع استخدام الوكيل اليوم؛ التجميد يمنع فقط الاشتراكات الفردية الجديدة.

Google Jules

Jules هو وكيل البرمجة غير المتزامن من Google — VM مدعوم بـ Gemini مع أفضل طبقة مجانية في الفئة (15 مهمة يومياً، 3 متزامنة). يفحص مستودعك بشكل استباقي بحثاً عن تعليقات #TODO ويعرض إصلاحات. الخطط المدفوعة تبدأ من 19.99 دولاراً شهرياً، لكن التسعير تغيّر عدة مرات في 2026.

التسعير. مجاني: 15 مهمة يومياً / 3 متزامنة. Pro يبدأ من 19.99$/شهر. Ultra يبدأ من 124.99$/شهر. تغيّر التسعير عدة مرات في 2026 — تحقق من الأرقام الحالية في jules.google قبل الشراء. (jules.google، تغطية TechCrunch للإصدار العام في أغسطس 2025، اعتباراً من 2026-04-26.)

نقاط القوة. أفضل طبقة مجانية في الفئة، نقطة. 15 مهمة/يوم مع 3 متزامنة مفيدة فعلاً للعمل الفردي، ليست مجرد إغراء. أنظف واجهة مستخدم في المجموعة لغير المستخدمين المتقدمين — حلقة "فحص TODO" أسلوب جديد ويكشف عمل تنظيف حقيقي دون أن تطلب منه.

نقاط الضعف. تذبذب التسعير هو المخاطرة الرئيسية؛ رأينا سعر طبقة Pro يتغير مرتين هذا العام. نظام التكامل أقل نضجاً من Devin أو Codex — روابط Slack/Linear/Jira أقل، أدوات مجتمعية أقل.

اختره إذا: كنت مطوراً مستقلاً أو فريقاً صغيراً يريد العمل غير المتزامن دون الالتزام بخطة مدفوعة مسبقاً — الطبقة المجانية لـ Jules مفيدة فعلاً وليست مجرد إغراء.

Factory Droids (Factory.ai)

"Droids" من Factory هي وكلاء مستقلون متخصصون يبرمجون ويختبرون ويراجعون وينشرون — مع خيارات تشغيل سحابية ومحلية. أغلقت Factory جولة Series C بقيمة 150 مليون دولار في 16 أبريل 2026، وتضم NVIDIA وAdobe وBayer وEY وMongoDB وZapier ضمن عملائها. التسعير يبدأ من 20 دولاراً شهرياً لمقعدين.

التسعير. الخطط المدفوعة تبدأ من 20$/شهر (تشمل مقعدَي فريق)، 5$ لكل مقعد إضافي. توجيه متعدد النماذج — Droids مختلفة للبرمجة والاختبار والمراجعة والنشر. (factory.ai/pricing، docs.factory.ai/pricing، تغطية تمويل Factory عبر SiliconANGLE، اعتباراً من 2026-04-26.)

نقاط القوة. شعارات العملاء تشير إلى ملاءمة القطاعات المنظَّمة — الرعاية الصحية والبنوك وصناعة أشباه الموصلات. التشغيل السحابي أو المحلي هو الخيار الوحيد في الفئة الذي يدعم التشغيل داخل المنشأة، وهو ما يهم الفرق التي لا تستطيع إرسال كودها إلى سحابة طرف ثالث. التنسيق متعدد الوكلاء عبر البرمجة/الاختبار/المراجعة/النشر مختلف فعلاً عن نموذج الوكيل الواحد الذي يستخدمه الآخرون.

نقاط الضعف. أقل شهرة من Devin أو Codex، ما يعني استغراق وقت أطول في إقناع فريقك. مبالغة للمطورين المستقلين — تنسيق Droids المتعدد يمثل عبئاً لا تحتاجه على مشروع جانبي.

اختره إذا: كنت في منظمة هندسية متوسطة إلى كبيرة لديها متطلبات حوكمة أو امتثال أو نشر معزول عن الشبكة.

إشارات جديرة بالذكر — OpenHands وAntigravity وAider

ثلاثة مرشحين يستحقون المعرفة: OpenHands هو أبرز وكيل خلفية مفتوح المصدر يمكن استضافته ذاتياً — اختره إذا أردت تحكماً كاملاً أو تشغيلاً معزولاً عن الشبكة. Google Antigravity هو المشارك الآخر الأقل شهرة من Google. Aider هو في جوهره وكيل CLI متزامن، لكن الفرق باتت تستخدمه بشكل متزايد في خطوط الأنابيب غير المتزامنة عبر سكريبتات Shell وخطافات CI. لا أحد منها يبلغ بعد مستوى استقلالية Devin.

OpenHands مفتوح المصدر، رخصة MIT-style، استضافة ذاتية على بنيتك التحتية. المقايضة أنك تُدير البيئة المعزولة بنفسك — سياسات الأمان وإدارة الأسرار وجاهزية المشغّل، كل ذلك على فريقك. الانتشار الفعلي الأقوى في البيئات المنظَّمة والأكاديمية حيث وكلاء السحابة خيار مستبعد.

Antigravity (Google) هو الشقيق الأهدأ لـ Jules — نفس نموذج VM وضجة تسويقية أقل، يُذكر أساساً في المراجعات الشاملة. الانتشار في الإنتاج خفيف اعتباراً من أبريل 2026.

Aider هو وكيل CLI متزامن في صميمه، لكن الفرق باتت تسلسله داخل CI لمحاكاة سلوك الخلفية — GitHub Action يُشغّل Aider بأمر، Aider يُنفذ، سير العمل يفتح PR. يعمل مع أي نموذج عبر API وهو BYOK افتراضياً، لذا هو أرخص خيار "شبيه بالخلفية" إذا توفرت لديك بنية CI.

اثنان آخران يستحقان المتابعة: Manus وGenie. كلاهما مشاركان حديثان مع إشارة انتشار واقعي منخفضة اعتباراً من أبريل 2026. تستحق المتابعة، لا الالتزام الآن.

أي وكيل برمجة في الخلفية يجب أن تختار؟

اختر وفق قيدك الأكبر. إذا كان الميزانية، تفوز الطبقة المجانية لـ Jules. إذا كان سير العمل الأصيل مع GitHub، يفوز Copilot Coding Agent. إذا كانت الاستقلالية في التذاكر المحددة، يفوز Devin. إذا كانت نتائج المعايير الخام، يفوز Claude Code Remote بـ SWE-bench Verified بنسبة 87.6%. إذا كانت الامتثال، فـ Factory Droids. إذا كان التكامل مع المحرر، فـ Cursor.

أولويتكالاختيارالسبب
أرخص بدايةGoogle Julesطبقة مجانية بـ 15 مهمة/يوم
سير عمل أصيل مع GitHub بصفر إعدادCopilot Coding Agentissue → PR كسير عمل التعيين
أعلى استقلاليةDevinVM كامل، متصفح، أنماط تفويض ناضجة
أعلى نتائج معاييرClaude Code Remote87.6% SWE-bench Verified (Opus 4.7)
السرعة / الإنتاجيةCodex Cloud~240 رمزاً/ثانية، متصدر Terminal-Bench 2.0
مستخدمو Cursor الحاليونCursor BG Agents8 وكلاء بالتوازي، تشغيل من Slack/Linear
قطاع منظَّمFactory Droidsامتثال + تشغيل محلي
استضافة ذاتية / مفتوح المصدرOpenHandsتحكم كامل، خيار معزول عن الشبكة

توصية المكدّس حسب حجم الفريق والميزانية

مطور مستقل — ابدأ بالطبقة المجانية لـ Jules للمهام الواضحة، ثم رقِّ إلى Cursor Pro بـ 20 دولاراً/شهر حين تتجاوز 15 مهمة/يوم. الإجمالي: 0-20$/شهر.

فريق صغير (2-10 مطورين) — Cursor Pro للعمل المدمج وBackground Agents، بالإضافة إلى Claude Code Pro للمهام المجدولة cron. الإجمالي: 40$/مطوّر/شهر.

مؤسسة (50+ مطوراً) — Copilot Enterprise لسير العمل الأصيل مع GitHub على معظم التذاكر، بالإضافة إلى Factory Droids للأعمال ذات الحساسية الحوكمية. الإجمالي: 39$ + 20-50$/مطوّر/شهر حسب عدد مقاعد Factory.

كم تكلّف كل أداة لكل مهمة؟

التكلفة الفعلية لكل مهمة تتفاوت كثيراً لأن كل بائع يُفوتر بطريقة مختلفة. Devin يتقاضى 4.50-6.75 دولار لإصلاح خطأ نموذجي (2-3 ACU). Cursor وCodex يُفوتران على استهلاك الرموز — توقع 0.30-3 دولار لكل مهمة حسب النموذج والسياق. Jules مجاني حتى 15 مهمة/يوم. Copilot يستخدم طلبات مميزة بما يعادل ~0.04 دولار لكل طلب على طبقة Pro.

الأداةنموذج الفوترةإصلاح خطأ نموذجيإعادة هيكلة متعددة الملفاتطبقة مجانية؟
Devin2.25$/ACU (1 ACU ≈ 15 دقيقة)4.50-6.75$ (2-3 ACU)67.50$+ (30 ACU)لا
Cursor BGعلى الرموز، رصيد استخدام مشمول~0.30-1.50$3-15$Hobby tier
Codex Cloudعلى الرموز منذ 2 أبريل 2026~0.20-1$2-10$لا (في Plus)
Claude Code Remoteمشمول في خطط Pro/Max~0.50-2$ (من الحصة)5-20$ (من الحصة)لا
Copilot Coding Agentطلبات مميزة (~0.04$ لكل طلب على Pro)1-3 طلبات5-20 طلباًمجاني: 50/شهر
Julesمجاني أو خطة ثابتة0$يُحسب من الحد اليومي15/يوم مجاناً
Factory Droidsعلى المقاعدمشمولمشموللا

الأسعار اعتباراً من 2026-04-26. تقديرات الرموز تفترض نماذج حدودية مع سياق مهمة متوسط. تحقق دائماً من لوحة استخدامك الخاصة.

"التكلفة النموذجية لإصلاح الأخطاء لكل وكيل برمجة في الخلفية (أبريل 2026)"

جدول البيانات
"التكلفة النموذجية لإصلاح الأخطاء لكل وكيل برمجة في الخلفية (أبريل 2026)"
"دولار لكل مهمة""إصلاح خطأ نموذجي"
"Jules (free tier)"0
"Codex Cloud"0.6
"Cursor BG"0.9
"Claude Code Remote"1.2
"Copilot CA (Pro premium req)"0.12
"Devin"5.6
"Factory Droids"0

تقديرات لمهمة إصلاح خطأ نموذجي تعادل 2-3 ACU أو ما يقابلها من رموز. التكلفة الفعلية تتفاوت بحسب اختيار النموذج وطول السياق. الأدوات ذات الطبقة المجانية أو الفوترة على المقاعد تُظهر تكلفة حدية صفرية.

الدرس من تشغيل هذه الأرقام: Devin أغلى بـ 5-10 أضعاف لكل مهمة مقارنةً بالمنافسين المُفوترين على الرموز. هذا الفارق في السعر يشتري لك الاستقلالية — أوامر أقل، مراقبة أقل في منتصف المهمة — لكن على إصلاحات الأخطاء الروتينية، يفوز Codex أو Cursor في التكلفة الخام.

أي وكيل برمجة في الخلفية يملك أفضل نتائج المعايير؟

Claude Opus 4.7 من Anthropic يتصدر SWE-bench Verified بنسبة 87.6%، مع gpt-5-codex من Codex في نطاق 77-80%. Codex يتصدر Terminal-Bench 2.0 بنسبة 77.3%. لكن المعايير تقيس ما يستطيعه النموذج الأساسي — معدل نجاحك الفعلي يعتمد بنفس القدر على منفّذ الوكيل والبيئة المعزولة والأوامر.

الأداةالنموذج الأساسيSWE-bench VerifiedTerminal-Bench 2.0ملاحظات
Claude Code RemoteClaude Opus 4.787.6%غ.م (متفاوت)أعلى نتيجة Verified
Codex Cloudgpt-5-codex~77-80%77.3%متصدر Terminal-Bench
Devinمجموعة Cognition (مختلطة)يُبلّغ عن قوة ذاتية في Junior-SWEغ.ميُبلّغ عن معدل اجتياز Junior-SWE لا Verified مباشرةً
Cursor BGنموذج حدودي من اختيار المستخدميرث نتيجة النموذجموروثتعتمد النتيجة على النموذج المختار
Copilot CAGPT/Claude (مقيّد بالخطة)موروثموروثتحديد النموذج مقيّد بالطبقة
JulesGemini 2.5/3غير معلن رسمياًغير معلن رسمياًشفافية أقل في المعايير
Factory Droidsتوجيه متعدد النماذجموروث حسب كل DroidموروثDroids مختلفة تستخدم نماذج مختلفة

للاطلاع على عرض تجميعي، مصفوفة وكلاء البرمجة في artificialanalysis.ai تتابع أرقام المعايير المتجددة عبر المزودين.

المعايير هي الحد الأدنى، لا السقف. رأينا Cursor BG مع Opus 4.7 يتفوق على Devin على نفس التذكرة — منفّذ الوكيل مهم. إذا كنت تبني منفّذ وكيلك الخاص بدلاً من الشراء، مقارنة LangGraph وCrewAI وOpenAI Agents SDK تستعرض خيارات الإطار التي تحدد الفجوة بين نتيجة النموذج ومعدل النجاح الواقعي.

هل يأمن منح وكلاء البرمجة في الخلفية وصولاً كاملاً للمستودع؟

كل أداة تعزل بطريقة مختلفة. Devin يشغّل VM معزولاً كاملاً. Codex يستخدم بيئة معزولة سحابية تديرها OpenAI. Cursor يُنشئ آلات بعيدة مؤقتة. Copilot يستخدم GitHub-managed runners (نموذج أمان GitHub Actions الحالي ينطبق عليه). Claude Code Remote يعمل في سحابة Anthropic. Factory يتيح السحابة أو المحلي المعزول. لا أحد منها "أعطه صلاحيات root على الإنتاج".

الأداةبيئة التشغيلخروج الشبكةالحالة المستمرةخيار معزول عن الشبكة
DevinVM معزول كامل (IDE + متصفح خاص)نعم، محدود النطاقلكل جلسةلا
Cursor BGVM سحابي مؤقتنعملالا
Codex Cloudبيئة معزولة OpenAIنعم، محدود النطاقلالا
Claude Code Remoteسحابة Anthropicنعم، محدود النطاقجلسات وكيل مستمرةلا
Copilot CAGitHub-managed runnerيرث إعدادات Actionsلكل تشغيلEnterprise فقط
JulesVM سحابي Googleنعملكل مهمةلا
Factory Droidsسحابي أو محليقابل للتهيئةقابل للتهيئةنعم

أسئلة المدير التقني قبل التبني

قبل منح أي من هؤلاء الوكلاء وصولاً للمستودع، أربعة أسئلة تحدد السياسة:

  1. صلاحيات المستودع — هل يحصل الوكيل على صلاحية الكتابة في main، أم يُقيَّد بفروع الميزات؟ دائماً قيّده بفروع الميزات مع إلزامية مراجعة PR.
  2. وصول الأسرار — هل يستطيع الوكيل قراءة ملفات .env أو استدعاء مدير الأسرار؟ رفض افتراضي مع استخدام رموز محدودة النطاق.
  3. خروج الشبكة — ما الذي تستطيع البيئة المعزولة الاتصال به؟ رفض الشبكة افتراضياً مع قائمة مسموح بها لسجلات الحزم ومرآتك الخاصة.
  4. الاحتفاظ بسجل المراجعة — كم تُحتفظ بجلسات الوكيل، وهل يستطيع فريق الأمان الاستعلام عنها؟ حدد ذلك كتابياً قبل منح الوصول.

هل يتدرب وكلاء البرمجة في الخلفية على كودي؟

الانضمام الافتراضي أو الانسحاب يتفاوت. خطط OpenAI Codex للمؤسسات لا تتدرب على كودك افتراضياً. Anthropic Claude Code لا يتدرب على كودك. GitHub Copilot Business وEnterprise لديهما استثناء البيانات. Cursor يتيح وضع الخصوصية. Devin ينص على أن الكود يبقى تحت سيطرة العميل. تحقق دائماً من سياسة استخدام البيانات الحالية في وثائق البائع قبل منح وصول المستودع.

السطر الواحد لكل أداة، مع السلوك الافتراضي الحالي:

  • Devin — الكود يبقى تحت سيطرة العميل، وفق سياسة Cognition
  • Cursor — زر تبديل وضع الخصوصية، الانضمام للتدريب اختياري
  • Codex Cloud — عدم التدريب افتراضي للمؤسسات؛ ChatGPT Plus يخضع لشروط المستهلك
  • Claude Code Remote — لا تدريب على كودك وفق الشروط التجارية لـ Anthropic
  • Copilot Business/Enterprise — استثناء البيانات افتراضي؛ Pro/Pro+ لديهما زر تبديل منفصل
  • Jules — شروط بيانات المؤسسة القياسية لـ Google تنطبق؛ تحقق من السياسة الحالية
  • Factory Droids — تحت سيطرة العميل وفق وثائقهم؛ التشغيل المحلي المعزول يُلغي السؤال من أساسه

السياسات تغيّرت عدة مرات في 2025-26. أعد التحقق قبل منح الوصول — البائعون يحدّثون الشروط أكثر مما تُحدَّث مقالات المدونات. بمجرد وصول PR من وكيل الخلفية، ستحتاج إلى مرور مراجعة كود بالذكاء الاصطناعي قبل الدمج — سؤال الملكية الفكرية لا يختفي لمجرد أن بائع الوكيل تعامل معه.

كيف تختار Techsy وكلاء الخلفية في مشاريع العملاء

في مشاريع عملاء Techsy نشغّل مجموعة متكاملة بدلاً من اختيار أداة واحدة. Cursor Background Agents تتولى العمل غير المتزامن داخل المحرر (المهندسون يعيشون في Cursor أصلاً). Claude Code Remote Tasks تُشغّل مهام cron مجدولة — رفع التبعيات الأسبوعية، مرورات ضمان الجودة الليلية، العمل الممل الذي يجب أتمتته. Codex Cloud يتولى الإنتاجية الرخيصة في الرموز على lint وتحديثات التبعيات حيث تتغلب السرعة على نتائج المعايير. نختار Devin للعملاء الذين يحتاجون استقلالية تفويض كاملة ولديهم متراكمات محددة بوضوح.

ما لا نستخدمه كثيراً: Copilot Coding Agent. رصيد الطلبات المميزة على Pro ينفد أسرع من البدائل عند مستوى استخدامنا، ولم يكن لدينا ما يكفي من عملاء Enterprise لتبرير الترقية. كنا سنبني منفّذاً مخصصاً مع LangGraph أو OpenAI Agents SDK قبل الارتباط ببائع واحد لطرح مؤسسي — لكن لـ 80% من أعمال العملاء على المشاريع الجديدة، الأدوات الجاهزة أعلاه أسرع من بناء الخاص. منصة نشر الذكاء الاصطناعي الوكيلي التي نستخدمها تتولى إدارة الوكلاء التي تنتجها هذه الأدوات في بيئة الإنتاج.

إذا أردت استشارة مجانية حول أي وكيل برمجة في الخلفية يناسب مجموعة أدواتك — أو منفّذ وكيل مخصص — يسعدنا تحديد النطاق معك.

الأسئلة الشائعة — مقارنة وكلاء البرمجة في الخلفية

ما هو وكيل البرمجة في الخلفية؟

وكيل البرمجة في الخلفية هو مهندس برمجيات بالذكاء الاصطناعي يعمل بشكل غير متزامن في بيئة سحابية معزولة. تعطيه مهمة — issue على GitHub أو تذكرة Linear أو رسالة Slack — ويعمل وحده دقائق أو ساعات، ثم يُعيد طلب سحب للمراجعة. السمة المميزة أنك لا تراقبه وهو يعمل؛ يعمل وأنت في مكان آخر.

ما الفرق بين وكيل البرمجة في الخلفية وCursor أو Copilot المدمجَين؟

وكلاء الخلفية يعملون بشكل غير متزامن في بيئة سحابية معزولة ويُعيدون طلبات سحب. الأدوات المدمجة كـ Cursor وCopilot تقترح الكود أثناء كتابتك، في محررك، بينما تقود كل ضغطة مفتاح. وكلاء الخلفية تُتيح التوازي (5 مهام في الانتظار، 5 PRs ترجع) بينما الوكلاء المدمجون يتيحون التكرار السريع على مهمة واحدة تركّز عليها.

كم تكلّف وكلاء البرمجة في الخلفية لكل مهمة؟

Devin يتكلف 4.50-6.75 دولار لإصلاح خطأ نموذجي بـ 2-3 ACU. Cursor وCodex Cloud يُفوتران على استهلاك الرموز، عادةً 0.30-3 دولار لكل مهمة حسب النموذج وطول السياق. Jules مجاني حتى 15 مهمة يومياً. Copilot Coding Agent يستخدم طلبات مميزة بما يعادل ~0.04 دولار لكل طلب على Pro — أرخص خيار لكل مهمة بين الخطط المدفوعة.

أي وكيل برمجة في الخلفية هو الأرخص للمطورين المستقلين؟

الطبقة المجانية لـ Google Jules لا منافس لها: 15 مهمة يومياً مع 3 وكلاء متزامنين بـ 0$/شهر. إذا تجاوزتها، Cursor Pro بـ 20 دولاراً/شهر مع 20 دولاراً من الاستخدام المشمول هو الخطوة التالية وتمنحك تكاملاً مع المحرر كميزة إضافية. لمعظم المطورين المستقلين، Jules يُغطي الاحتياجات اليومية دون أي دفع.

هل يأمن منح وكلاء البرمجة في الخلفية وصولاً كاملاً للمستودع؟

نعم، مع تحفظات. استخدم رموزاً محدودة النطاق (لا رمز وصولك الشخصي)، رفض الشبكة افتراضياً مع قائمة مسموح بها، قيّد الوكيل بفروع الميزات مع إلزامية مراجعة PR، وراجع سجلات المراجعة أسبوعياً. لا تمنح أبداً صلاحيات الكتابة في الإنتاج لأي من هؤلاء الوكلاء. عامل الوكيل كمستشار خارجي: ثق، لكن راجع كل PR.

هل يتدرب وكلاء البرمجة في الخلفية على كودي؟

Anthropic Claude Code وخطط OpenAI Codex للمؤسسات وGitHub Copilot Business/Enterprise يُعينون عدم التدريب على كودك افتراضياً. Cursor يتيح وضع الخصوصية. Devin ينص على أن الكود يبقى تحت سيطرة العميل. تحقق دائماً من سياسة استخدام البيانات الحالية في وثائق البائع قبل منح وصول المستودع — السياسات تغيّرت عدة مرات في 2025-26.

هل يستطيع وكيل البرمجة في الخلفية دمج طلبات سحبه بنفسه؟

معظمها تستطيع إذا منحتها الصلاحية، لكن كل فريق نعمل معه يشترط مراجعة بشرية قبل الدمج. القدرة التقنية موجودة — Copilot وDevin وCursor يمكنها جميعاً الدمج التلقائي إذا سمح حماية الفرع — لكن الدمج التلقائي مخاطرة. بوابة مراجعة PR هي آخر شبكة أمان رخيصة قبل وصول خطأ الوكيل إلى الإنتاج.

ما أفضل وكيل برمجة في الخلفية لفرق المؤسسات؟

إجابتان تعتمدان على بيئتك. إذا كنت متجذراً في GitHub Enterprise، Copilot Coding Agent هو الاختيار الأقل احتكاكاً — تعيين issue كسير عمل، لا أدوات إضافية. إذا كانت لديك متطلبات حوكمة أو امتثال أو تشغيل معزول عن الشبكة، Factory Droids هو الخيار الوحيد الذي يتيح التشغيل المحلي والتنسيق متعدد الوكلاء عبر البرمجة والاختبار والمراجعة والنشر.

أي وكيل برمجة في الخلفية يملك أفضل طبقة مجانية؟

Google Jules يفوز بلا منافس. 15 مهمة يومياً، 3 وكلاء متزامنين، وصول كامل لـ Gemini — بـ 0$/شهر ودون حد زمني. الطبقة المجانية لـ Copilot (50 طلباً مميزاً/شهر) تأتي في المرتبة الثانية بفارق كبير؛ Hobby tier في Cursor مجانية تقنياً لكن لا تُغطي استخدام وكيل الخلفية بشكل مجدٍ. Jules هي الطبقة المجانية الوحيدة التي رأيناها تحل محل خطة مدفوعة للعمل الفردي.

متى أستخدم وكيل الخلفية مقابل ذكاء اصطناعي مدمج كـ Cursor؟

استخدم وكيل الخلفية حين تكون المهمة محددة بوضوح وتستغرق أكثر من 15 دقيقة ولا تحتاج تصحيح المسار في منتصف التنفيذ — ترقيات التبعيات، إعادة الهيكلة المتكررة، الترحيل متعدد الملفات، أو أي شيء تستطيع وصفه في تذكرة واضحة. استخدم الأداة المدمجة حين تبني نماذج أولية أو تستكشف أو تبرمج بالزوج مع النموذج على عمل جديد.

الخلاصة

  • Devin للتفويض، Cursor BG إذا كنت تعيش في Cursor، Codex Cloud لمستخدمي ChatGPT Pro، Claude Code Remote للمعايير، Copilot للعمل الأصيل مع GitHub، Jules للطبقة المجانية، Factory للامتثال.
  • تذبذب الأسعار حقيقي — خفض Devin في أبريل 2026 وإصلاح رموز Codex وتجميد اشتراكات Copilot كلها حدثت هذا الشهر. تحقق قبل الشراء.
  • فئة العمل غير المتزامن عمرها سنة وتشحن بسرعة. توقع أن تتغير هذه المصفوفة مجدداً قبل الصيف.

تريد مساعدة في الاختيار أو ربط وكيل خلفية بمجموعة أدواتك؟ احصل على استشارة مجانية.

الوسوم

background-coding-agentsdevincursorcodexclaude-codeai-developmentllm-tooling

شارك هذا المقال

مقالات ذات صلة

المزيد في ai-machine-learning

ai-machine-learning
Aug 22, 2026

أفضل منشئي المواقع بالذكاء الاصطناعي: قارنا 8 وننشر 2

خطة Framer Basic بسعر 10$/شهر هي الخيار الافتراضي لموقع وكالة من صفحة واحدة بين أفضل منشئي المواقع بالذكاء الاصطناعي التي قيّمناها في 17 أغسطس 2026. وDurable أسرع وصولًا إلى رابط منشور. أما Webflow فهي الوجهة عندما تكون الحاجة تحكمًا بمستوى Designer.

8 دقائق قراءة قراءة
اقرأ
ai-machine-learning
Aug 12, 2026

Grok 4.6 مقابل Grok 4.5: أجرينا 80 استدعاء API يوم الإطلاق – نتيجة متطابقة 40/40 بفاتورة 1.38×

أطلقت SpaceXAI نموذج Grok 4.6 في 12 أغسطس 2026 بنفس بطاقة أسعار Grok 4.5 وهي `$2/$6`. أرسلنا 80 استدعاء API متطابقًا إلى النموذجين في اليوم نفسه: تعادلت الدقة عند `40/40`، بينما استهلك النموذج الأحدث 1.90× من متوسط رموز الإخراج وكلّف 1.38× من المال.

8 دقائق قراءة قراءة
اقرأ
ai-machine-learning
Aug 8, 2026

الجلسات والتتبعات والفترات في مراقبة LLM: أحدها ليس مستوى بنيويًا

الجلسات والتتبعات والفترات تتداخل في مراقبة LLM، لكن مواصفات OpenTelemetry GenAI لا تعرّف سوى اثنين منها كمستويات بنيوية. قرأنا وثائق خمسة مزودين والمواصفات نفسها لتحديد مكان كل مفهوم فعليًا.

13 دقيقة قراءة قراءة
اقرأ
ابدأ مشروعك

هل أنت مستعد لبناء شيء استثنائي؟

دعنا نحول رؤيتك إلى واقع. فريقنا جاهز لمساعدتك في إنشاء برمجيات تصنع الفرق.