ai-machine-learning

Devin vs Claude Code vs Codex 2026: 8 Kodlama Ajanı Test Edildi

Yazan Techsy Editorial Team
Güncellendi May 12, 2026
19 okuma
Devin vs Claude Code vs Codex 2026: 8 Kodlama Ajanı Test Edildi

8 Arka Plan Kodlama Ajanı Karşılaştırması: Fiyatlandırma, Benchmark'lar ve Kimler İçin (Nisan 2026)

Arka plan kodlama ajanları on iki ayda araştırma demosu olmaktan çıkıp sıradan bir araç haline geldi. Cognition bu Nisan'da Devin'in fiyat tabanını 500 dolardan 20 dolara indirdi, OpenAI Codex faturalandırmasını 2 Nisan'da yeniden yapılandırdı ve Factory iki hafta önce 150 milyon dolarlık Seri C kapattı. Bu ay sekizini de Techsy'nin iç araç geliştirme çalışmalarında üretimde test ettik ve aşağıdaki rakamlar gerçekten ödediklerimiz. Bu araçlardan hiçbirini satmıyoruz, affiliate bağlantımız yok; bu sorgu için ilk 10 sonucun neredeyse tamamı listedeki ajanlardan birinin satıcısı tarafından yayınlanıyor.

AraçBaşlangıç fiyatıEn iyi modelSandbox / bulutGitHub-nativeKimler içinÖnemli istatistik
Devin$20/ay + $2,25/ACUCognition stackTam VM (kendi IDE+tarayıcısı)GH App üzerinden PRUçtan uca backlog devretmeHata düzeltme başına ~$5
Cursor BG Agents$20/ay (Pro)Seçilen frontier modelGeçici bulut VMEntegrasyon üzerinden PRCursor kullanıcıları için async8 paralel ajana kadar
Codex Cloud$20/ay (Plus) → $200 (Pro)OpenAI gpt-5-codexOpenAI bulut sandboxCodex CLI / web üzerinden PRChatGPT Pro kullanıcıları%77,3 Terminal-Bench 2.0
Claude Code Remote$20/ay (Pro) → $200 (Max 20x)Claude Opus 4.7Anthropic bulutuGH App üzerinden PRClaude Code güç kullanıcıları + cron%87,6 SWE-bench Verified
Copilot Coding Agent$10/ay (Pro) → $39 (Enterprise)GPT/Claude (kademeli)GitHub yönetimli runnerNative (issue → PR)GH Enterprise/Business ekipleriEn derin GH entegrasyonu
Google JulesÜcretsiz (15/gün) → $19,99+GeminiGoogle bulut VMEntegrasyon üzerinden PRSolo geliştiriciler / küçük ekiplerKategorideki en iyi ücretsiz katman
Factory Droids$20/ay (2 koltuk)Çoklu model yönlendirmeBulut + yerel seçenekEntegrasyon üzerinden PRDüzenlemeli sektörlerNVIDIA, Adobe, Bayer'de kullanılıyor
Onurlu sözlerdeğişkendeğişkendeğişkendeğişkenOSS / DIY pipeline'larOpenHands, Antigravity, Aider

Fiyatlandırma 2026-04-26 itibarıyla. Token ve ACU tabanlı planlar, temel ücretin üzerine eklenir. Satın almadan önce doğrulayın — her araç bölümündeki satıcı bağlantılarına bakın. Mevcut bir repo üzerinde çalışmak yerine sıfırdan üretim için lovable-vs-bolt-vs-v0 karşılaştırmamıza bakabilirsiniz.

Arka plan kodlama ajanı nedir?

Arka plan kodlama ajanı, sandbox'lı bir bulut ortamında asenkron çalışan bir yapay zeka yazılım mühendisidir. Bir görev atarsınız — bir GitHub issue'su, Linear ticket'ı, Slack mesajı — ve ajan dakikalarca ya da saatlerce tek başına çalışır, ardından incelemeniz için bir pull request döndürür. Yazarken izlemezsiniz.

İşte ayırt edici özellik bu. Cursor ve Copilot gibi satır içi araçlar siz yazarken öneri sunar; arka plan yapay zeka ajanları ise kuyruğa alınır, çalıştırılır ve raporlarını geri gönderir. Yaşam döngüsü listedeki her araçta aynıdır: ticket → bulut sandbox → otonom düzenleme → PR → insan incelemesi.

Bu kategori, Devin'in piyasaya çıkışıyla birlikte 2024'ün sonlarında uzun ufuklu ajansal yetenekler olgunlaşınca var oldu; 2025 ise Codex Cloud, Cursor Background Agents ve Jules'ü ekledi. Anthropic'in Claude Code Remote Tasks'ı 20 Mart 2026'da geldi ve "ayarla-unut" akışı artık ana akım.

Neden önemli? Paralellik. Cuma öğleden sonra beş iyi tanımlanmış ticket kuyruğa alıp Pazartesi sabahı beş PR inceleyebilirsiniz. Bu, bir modelle pair-programming yapmaktan farklı bir iş akışı — daha çok yanında yazarken değil, junior bir geliştiriciyi yönetmek gibi. "claude code background agent support" aramasını yapan insanlar da var, bu nedenle Claude Code Remote Tasks'ı burada sadece Devin yanında ele alıyoruz. Satır içi tarafı Claude Code, Cursor ve Copilot arasındaki satır içi kodlama ajanı ayrımı yazımızda ayrıca inceledik. Kategori düzeyinde bir mimari açıklama için Tembo'nun primer'ı makul bir başlangıç noktası.

Arka plan ile satır içi kodlama ajanları — async ne zaman sync'i geçer?

Async arka plan ajanları, bir görev 15 dakikadan uzun sürdüğünde ve düzenleme ortasında yön değiştirmenize gerek kalmadığında kazanır — iyi tanımlı hata düzeltmeleri, bağımlılık güncellemeleri, tekrarlayan yeniden düzenlemeler, çok dosyalı geçişler. Cursor veya Copilot gibi satır içi ajanlar ise keşfediyorsanız, prototip üretiyorsanız ya da modelle pair-programming yapıyorsanız ve gerçek zamanlı tepki vermeniz gerekiyorsa kazanır.

Özet bu kadar. Aşağıdaki karar matrisi, Techsy projelerinde gerçekte nasıl seçim yaptığımızı gösteriyor:

Async kullanın (arka plan)Satır içi kullanın (Cursor/Copilot)
Görev iyi tanımlanmış (kabul kriterleri olan issue)Keşfediyor ya da prototip yapıyorsunuz
Tahmini çalışma > 15 dkDüzenleme ortasında yön değiştirmeniz gerekiyor
3+ görevi paralel çalıştırmak istiyorsunuzTek bir odaklanmış oturum istiyorsunuz
PR'ı sonradan incelemenize hazırsınızYazarken önerileri görmek istiyorsunuz
Görev tekrarlı (bağımlılıklar, geçişler, lint)Görev yeni ve yaratıcı

Somut olarak: "47 paketi yükselttim ve kırıcı değişiklikleri düzelttim" ders kitabındaki bir async kodlama ajanı işi — iyi tanımlanmış, mekanik, paralelleştirilebilir. "Yeni bir dashboard route'u inşa ettim" satır içi — düzen, metin ve kenar durumlar üzerinde gidip geleceğinizi biliyorsunuz.

Sync ile async arasındaki el değişimi

Birlikte çalıştığımız ekiplerin çoğu sonunda ikisini birden kullanıyor. Yeni kod için Cursor satır içi, yükseltmeler için Cursor Background Agents. Mimari çalışmalar için Claude Code etkileşimli, haftalık bağımlılık güncelleme cron'u için Claude Code Remote Tasks. El değişimi bir iş akışı — hiçbir araç diğerini değiştirmiyor. Editörünüzde kalmak istiyorsanız, Windsurf vs Cursor karşılaştırması sync tarafını ayrıntılı ele alıyor.

Görev 15 dakikadan uzun sürüyorsa ve izlemenize gerek yoksa — async kazanır.

Devin (Cognition) — özerklik lideri

Devin, piyasadaki en özerk arka plan ajanı — Cognition ona kendi IDE'si, tarayıcısı ve terminaliyle tam sandbox VM veriyor. Fiyatlandırma Nisan 2026'da 500 $/ay enterprise tabanından $20/ay + $2,25 ACU (Agent Compute Unit) başına seviyesine indi; bu, otonom kodlama ajanları başlığının aylık kahramanı oldu.

Fiyatlandırma. Core $20/ay + $2,25/ACU. Team $500/ay, 250 ACU dahil, ek ACU'lar $2'den. 1 ACU yaklaşık 15 dakikalık çalışma. Tipik bir hata düzeltmesi 2-3 ACU, yani $4,50-6,75. Çok dosyalı bir geçiş 30+ ACU'ya ulaşabilir, yani $67,50 ve üzeri. (devin.ai/pricing, 2026-04-26 itibarıyla.)

Güçlü yanlar. Listedeki en yüksek özerklik. VM bir tarayıcı içerdiğinden Devin, bağlamı elle beslemeden dokümanları ve Stack Overflow'u okuyabilir. Olgun bir ürün — Cognition Mart 2024'te yayınlandı ve Devin'i gerçekten kullanışlı kılan promptları iyileştirmek için iki yılı var.

Zayıf yanlar. ACU maliyetleri yeni çalışmalarda tahmin edilemez hale gelebiliyor. Codex veya Cursor'a kıyasla görev ortasında daha az kontrol — görevi ayarlayıp gidiyorsunuz, bu Devin bir yazım hatasını düzeltmek için 8 ACU harcayana kadar sorunsuz. Belirsiz ticket'lar belirsiz PR'lar üretir.

Şunu seçin: İyi tanımlanmış backlog öğelerini uçtan uca devretmek istiyorsanız ve ekibiniz net kabul kriterleri yazabiliyorsa.

Cursor Background Agents

Cursor'un Background Agents'ı, Cursor editörü içinde async çalışır — Slack, Linear, GitHub veya editör içinden tetiklenebilir, 8'e kadar paralel. Seçtiğiniz frontier modeli kullandıklarından maliyet, sabit bir ACU oranı değil token tüketimine bağlıdır. Pro aylık $20, 20 $ kullanım dahil.

Fiyatlandırma. Hobby $0, Pro $20/ay ($20 kullanım dahil), Pro+ $60/ay ($70 kullanım), Ultra $200/ay ($400 kullanım), Teams $40/kullanıcı/ay. Arka plan ajanları, model + bağlam uzunluğu + çıktı uzunluğuna dayalı kullanım bazlı faturalanır. (cursor.com/pricing, 2026-04-26 itibarıyla. Background Agents özelliği Cursor 0.50'de yayınlandı.)

Güçlü yanlar. Listedeki en sıkı editör entegrasyonu — satır içi oturumunuz, arka plan ajanınız ve kurallarınız tek bir araçta. 8'e kadar paralel ajan, modüller arasında yeniden düzenlemeyi birkaç dakikada tamamlamanızı sağlar. Slack, Linear ve GitHub tetikleyicileri "hangi arka plan ajanı Linear ve Slack ile çalışıyor" sorusunu yanıtlar — Cursor, native olarak yapıyor.

Zayıf yanlar. Frontier model kullanımı dahil edilen $20 bütçeyi düşündüğünüzden hızlı tüketir; Opus ağırlıklı bir oturum onu bitirebilir. Kullanım panosunu haftada bir kontrol etmeyen ekipler için görev başına maliyet faturaya kadar belirsiz kalır.

Şunu seçin: Zaten Cursor'da yaşıyorsanız ve araç değiştirmeden async istiyorsanız — kullanım panosunu haftada bir okumaya hazırsanız. Cursor Rules, satır içi ve arka plan oturumlarının ikisini de besler, dolayısıyla halihazırda Cursor kullanıcısıysanız kurulum maliyeti neredeyse sıfır.

Codex Cloud (OpenAI)

Codex Cloud, OpenAI'ın async kodlama ajanı. Bir görev tanımlıyorsunuz, Codex bir sandbox VM başlatıyor, repo'nuzu klonluyor ve bir PR döndürüyor. %77,3 ile Terminal-Bench 2.0 lideri, saniyede ~240 token hızıyla çalışıyor (Opus'un yaklaşık 2,5 katı) ve 2 Nisan 2026'da token tabanlı faturalamaya geçti.

Fiyatlandırma. ChatGPT Plus'a dahil ($20/ay). Yeni Pro katmanı $100/ay (5 kat Plus kullanımı; 31 Mayıs 2026'ya kadar tanıtım kampanyasıyla 2x = 10x). Pro $200/ay. Token tabanlı faturalama 02-04-2026'dan itibaren. Codex CLI açık kaynak ve BYOK ile ücretsiz. Aktif kullanıcılar için gerçek dünya maliyeti ~$100-200/geliştiriciler/ay. (developers.openai.com/codex/pricing, TechCrunch $100 Pro katmanı haberi, 2026-04-26 itibarıyla.)

Güçlü yanlar. Saniyede ~240 token ile verim şampiyonu — birçok dosyada bağımlılık yükseltme gibi token ağır görevlerde Codex, Claude hâlâ düşünürken bitirmiş oluyor. CLI açık kaynak ve kendi API anahtarınızla çalışıyor, dolayısıyla ChatGPT Pro ödemeden Codex'i CI'a entegre edebilirsiniz. Dağıtım muazzam: her ChatGPT Plus kullanıcısı zaten sahip.

Zayıf yanlar. Token faturalandırması görevden göreve tahmin etmesi gerçekten zor. 2 Nisan reformu eski karşılaştırmaları geçersiz kılıyor — o tarihten önce okuduğunuz her şey fiyat açısından yanlış. CLI, web Codex'inden ayrı bir ürün gibi hissettiriyor; entegrasyon gevşek.

Şunu seçin: ChatGPT Pro kullanıcısıysanız ve derinden entegre bir bulut ajanı istiyorsanız — ya da kendi anahtarınızı getirmek isteyen bir CLI tutkunuysanız.

bash
# CLI'dan Codex Cloud'a görev gönder
codex task create \
  --repo "techsy-io/example-app" \
  --branch "main" \
  --prompt "Bump all dependencies to latest and fix breaking changes" \
  --watch

Claude Code Remote Tasks (Anthropic)

Claude Code Remote Tasks, bir GitHub repo'su, bir prompt ve bir zamanlama tanımlamanıza olanak tanır — Claude, Anthropic'in bulutunda otonom çalışır ve bitince bir PR açar. 20 Mart 2026'da yayınlandı. Opus 4.7'nin kategoride lider %87,6 SWE-bench Verified skoru ve SWE-bench Pro'da %64,3 ile destekleniyor. Bu, "claude code background agent support" otomatik tamamlama aramasının yanıtı — gerçek, yayınlanmış bir ürün.

Fiyatlandırma. Claude Code Pro/Max planlarına dahil. Pro $20/ay, Max 5x $100/ay, Max 20x $200/ay. Yoğun kullanıcılar gerçek dünyada $100-200/ay ödüyor. (claude.com/code, platform.claude.com/docs/en/managed-agents/overview, 2026-04-26 itibarıyla.)

Güçlü yanlar. Listedeki en yüksek SWE-bench Verified skoru (%87,6). Kalıcı durumlu ajan oturumları — Remote Task, her çalıştırmada soğuk başlamak yerine kaldığı yerden devam edebilir. Hook'lar ve Claude Code'un mevcut araç ekosistemiyle entegre olur; mevcut beceriler, slash komutları ve alt ajanlar, etkileşimli oturumlardaki gibi çalışır.

Zayıf yanlar. Listedeki en yeni ajan — Devin veya Codex'e kıyasla daha az belgelenmiş entegrasyon kalıbı, kopyalanacak daha az topluluk örneği. CLI öncelikli; GUI yok, bu da ekipteki CLI'dan uzak geliştiriciler için eşiği yükseltiyor.

Şunu seçin: Claude Code güç kullanıcısıysanız ve tekrarlayan zamanlanmış görevler istiyorsanız — haftalık bağımlılık güncellemeleri, cron tarzı yeniden düzenlemeler, isteğe bağlı QA geçişleri. Claude Code hook'larını Remote Tasks'a etkileşimli oturumlardaki gibi bağlayabilirsiniz; Remote Tasks, Mart ayında ele aldığımız sızdırılan-sonra-yayınlanan özelliklerden biriydi.

bash
# Claude Code'da tekrarlayan Remote Task zamanlayın
claude-code remote create \
  --repo "techsy-io/example-app" \
  --schedule "weekly" \
  --prompt "Bump deps, run tests, open PR if green"

Copilot Coding Agent (GitHub)

Copilot Coding Agent bir GitHub issue'sunu pull request'e dönüştürür — ajanı bir takım arkadaşı atar gibi atarsınız. Bu listedeki en native GitHub iş akışı. Not: 20 Nisan 2026 itibarıyla GitHub yeni Pro ve Pro+ kayıtlarını durdurdu; mevcut aboneler ile Business/Enterprise katmanları etkilenmiyor.

Fiyatlandırma. Free $0, Pro $10/ay, Pro+ $39/ay, Business $19/kullanıcı/ay, Enterprise $39/kullanıcı/ay. Premium istek bazlı: Free 50/ay, Pro 300/ay, Pro+ 1500/ay, Enterprise 1000/kullanıcı/ay. Pro/Pro+/öğrenci yeni kayıtlar 2026-04-20'den itibaren durduruldu — Business/Enterprise hâlâ açık. (github.com/features/copilot/plans, 2026-04-26 itibarıyla.)

Güçlü yanlar. Kategorideki en derin GitHub entegrasyonu. Issue-to-PR, listedeki en native iş akışı — ekstra uygulama yok, ekstra pano yok; ajan, halihazırda kullandığınız aynı arayüzde bir atanan olarak görünüyor. Mart 2026 Code Review güncellemesi, inceleme yorumlarını otomatik olarak kodlama ajanına iletebiliyor; bu da GitHub'dan çıkmadan döngüyü kapatıyor.

Zayıf yanlar. Alt kademelerde sınırlı model seçimi — Pro'da Opus'u seçemezsiniz, örneğin. Pro'da aylık 300 isteklik premium istek bütçesi, günlük teslimat yapıyorsanız hızla tükeniyor. Yeni kayıt duraklaması, yeni bireysel aboneler için sürtünme yaratıyor.

Şunu seçin: Ekibiniz zaten GitHub Business veya Enterprise'daysa ve sıfır kurulumlu async kodlama istiyorsanız. Mevcut koltuklar ajanı bugün kullanabilir; duraklama yalnızca yeni bireysel kayıtları engelliyor.

Google Jules

Jules, Google'ın async kodlama ajanı — kategorideki en iyi ücretsiz katmana sahip Gemini destekli bir VM (günde 15 görev, 3 eşzamanlı). Repo'nuzu otomatik olarak #TODO yorumları açısından tarar ve düzeltmeler önerir. Ücretli planlar $19,99/ay'dan başlıyor, ancak 2026'da fiyatlandırma birkaç kez değişti.

Fiyatlandırma. Ücretsiz: 15 günlük görev / 3 eşzamanlı. Pro $19,99/ay'dan başlıyor. Ultra $124,99/ay'dan başlıyor. 2026'da fiyatlandırma birçok kez değişti — satın almadan önce güncel rakamları jules.google adresinde doğrulayın. (jules.google, TechCrunch GA haberi Ağustos 2025, 2026-04-26 itibarıyla.)

Güçlü yanlar. Kategorideki en iyi ücretsiz katman, tartışmasız. Günde 15 görev ve 3 eşzamanlı, solo çalışma için gerçekten kullanışlı — bir teaser değil. Güç kullanıcısı olmayanlar için en temiz UX: "TODO tara" döngüsü yeni ve gerçek temizleme çalışmalarını siz prompt vermeden ortaya çıkarıyor.

Zayıf yanlar. Fiyat dalgalanması en büyük risk; Pro katman fiyatının bu yıl iki kez değiştiğini izledik. Devin veya Codex'e kıyasla daha az olgun entegrasyon ekosistemi — daha az Slack/Linear/Jira kancası, daha az topluluk araçları.

Şunu seçin: Önceden ücretli plana bağlanmadan async isteyen solo bir geliştirici ya da küçük bir ekipseniz — Jules'ün ücretsiz katmanı gerçekten işe yarıyor, bir teaser değil.

Factory Droids (Factory.ai)

Factory'nin "Droids"ları, bulut ve yerel çalıştırma seçenekleriyle kod yazan, test eden, inceleyen ve deploy eden özelleşmiş otonom ajanlardır. Factory, 16 Nisan 2026'da 150 milyon dolarlık Seri C kapattı ve müşteri olarak NVIDIA, Adobe, Bayer, EY, MongoDB ve Zapier'i listeliyor. Fiyatlandırma iki koltuk için $20/ay'dan başlıyor.

Fiyatlandırma. Ücretli planlar $20/ay'dan başlıyor (2 takım koltuğu dahil), ek koltuk $5. Çoklu Droid model yönlendirme — kod, test, inceleme, deploy için farklı Droids. (factory.ai/pricing, docs.factory.ai/pricing, Factory finansman haberi SiliconANGLE üzerinden, 2026-04-26 itibarıyla.)

Güçlü yanlar. Müşteri logoları düzenlemeli sektör uyumunu gösteriyor — sağlık, bankacılık, yarı iletkenler. Bulut VEYA yerel çalıştırma, kategorideki tek şirket içi seçenek — üçüncü taraf bir buluta kod gönderemeyen ekipler için kritik. Kod/test/inceleme/deploy üzerinde çok ajanlı koordinasyon, diğerlerinin kullandığı tek ajanlı modelden gerçekten farklı.

Zayıf yanlar. Devin veya Codex'e kıyasla daha az isim tanınırlığı; iç benimseme daha uzun sürüyor. Solo geliştiriciler için fazla — çok Droid orkestrasyonu, yan projede ödemek istemediğiniz bir vergi.

Şunu seçin: Yönetişim, uyumluluk veya hava boşluklu deployment gereksinimleri olan orta-büyük ölçekli bir mühendislik organizasyonuysanız.

Onurlu sözler — OpenHands, Antigravity, Aider

Bilinmesi gereken üç finalist: OpenHands, öne çıkan açık kaynak kendi sunucusunda çalıştırılan arka plan ajanı — tam kontrol veya hava boşluklu operasyon istiyorsanız seçin. Google Antigravity, Google'ın daha az duyurulan diğer girişimcisi. Aider teknik olarak sync bir CLI ama giderek daha fazla shell script'leri ve CI kancaları aracılığıyla async pipeline'larda kullanılıyor. Hiçbirinin Devin sınıfı özerkliği henüz yok.

OpenHands açık kaynak, MIT tarzı lisans, kendi altyapınızda kendi sunucunuzda çalıştırın. Dezavantajı, sandbox'ı kendiniz yönetmeniz — güvenlik politikaları, gizli yönetim, runner uptime, hepsi ekibinizde. Gerçek dünya benimsemesi en çok, bulut ajanlarının söz konusu olmadığı düzenlemeli ve akademik ortamlarda.

Antigravity (Google), Jules'ün sessiz kardeşi — aynı VM modeli, daha az pazarlama, çoğunlukla derlemelerde bahsediliyor. Nisan 2026 itibarıyla prodüksiyon traction'ı sınırlı.

Aider özünde bir CLI sync ajanı, ancak ekipler giderek daha fazla onu CI içinde arka plan davranışını taklit etmek için zincirliyor — bir GitHub Action prompt'la Aider'ı tetikliyor, Aider commit ediyor, iş akışı bir PR açıyor. API aracılığıyla herhangi bir modelle çalışır ve varsayılan olarak BYOK, dolayısıyla CI altyapısı olan biri için en ucuz "arka plan tarzı" seçenek.

İzlenecek iki araç daha: Manus ve Genie. Her ikisi de Nisan 2026 itibarıyla düşük gerçek dünya benimseme sinyali olan daha yeni girişimler. İzlemeye değer, bağlanmaya değil.

Hangi arka plan kodlama ajanını seçmelisiniz?

En büyük kısıtlamanıza göre seçin. Bütçeyse Jules'ün ücretsiz katmanı kazanır. GitHub-native iş akışıysa Copilot Coding Agent kazanır. İyi tanımlanmış ticket'larda özerklikse Devin kazanır. Ham benchmark skorlarıysa Claude Code Remote %87,6 ile SWE-bench Verified'da kazanır. Uyumluluksa Factory Droids. Editör entegrasyonuysa Cursor.

ÖnceliğinizSeçimNeden
En ucuz başlangıçGoogle JulesGünde 15 görevle ücretsiz katman
GitHub-native sıfır kurulumCopilot Coding AgentIssue → PR atama iş akışı
En yüksek özerklikDevinTam VM, tarayıcı, olgun delege kalıpları
En yüksek benchmark skorlarıClaude Code Remote%87,6 SWE-bench Verified (Opus 4.7)
Hız / verimCodex Cloud~240 tps, Terminal-Bench 2.0 lideri
Cursor kullanıcılarıCursor BG Agents8 paralel, Slack/Linear tetikleyicileri
Düzenlemeli sektörFactory DroidsUyumluluk + yerel çalıştırma
Kendi sunucusunda / OSSOpenHandsTam kontrol, hava boşluklu seçenek

Ekip büyüklüğüne ve bütçeye göre yığın önerisi

Solo geliştirici — açık kazanımlar için Jules'ün ücretsiz katmanıyla başlayın, günde 15 görevi aştıktan sonra $20/ay ile Cursor Pro'ya geçin. Toplam: $0-20/ay.

Küçük ekip (2-10 geliştirici) — satır içi artı Background Agents için Cursor Pro, zamanlanmış cron tarzı görevler için Claude Code Pro. Toplam: geliştirici başına $40/ay.

Enterprise (50+ geliştirici) — ticket'ların büyük kısmında GitHub-native iş akışı için Copilot Enterprise, yönetişim açısından hassas iş yükleri için Factory Droids. Toplam: Factory koltuk sayısına bağlı olarak $39 + $20-50/geliştirici/ay.

Her arka plan kodlama ajanı görev başına ne kadar maliyetli?

Görev başına gerçek maliyet, her satıcının farklı faturalandırması nedeniyle büyük farklılıklar gösteriyor. Devin tipik bir hata düzeltmesi için $4,50-6,75 (2-3 ACU) talep ediyor. Cursor ve Codex token tüketimine göre faturalandırıyor — model ve bağlama bağlı olarak görev başına $0,30-3 bekleyin. Jules günde 15 göreve kadar ücretsiz. Copilot Pro katmanında kabaca $0,04 birim fiyatıyla premium istekler kullanıyor.

AraçFaturalama modeliTipik hata düzeltmesiÇok dosyalı yeniden düzenlemeÜcretsiz katman?
Devin$2,25/ACU (1 ACU ≈ 15 dk)$4,50-6,75 (2-3 ACU)$67,50+ (30 ACU)Hayır
Cursor BGToken bazlı, dahil $-bütçesi~$0,30-1,50$3-15Hobby katmanı
Codex Cloud2 Nis 2026'dan itibaren token bazlı~$0,20-1$2-10Hayır (Plus'ta dahil)
Claude Code RemotePro/Max planlara dahil~$0,50-2 (kotaya karşı)$5-20 (kotaya karşı)Hayır
Copilot Coding AgentPremium istek bazlı (~Pro'da $0,04)1-3 istek5-20 istekÜcretsiz 50/ay
JulesÜcretsiz katman veya sabit plan$0Günlük limite sayılırGünde 15 ücretsiz
Factory DroidsKoltuk bazlıDahilDahilHayır

Fiyatlandırma 2026-04-26 itibarıyla. Token tahminleri, ortalama görev bağlamıyla frontier modelleri varsayıyor. Her zaman kendi kullanım panonuza göre doğrulayın.

"Arka plan kodlama ajanı başına tipik hata düzeltme maliyeti (Nisan 2026)"

Veri tablosu
"Arka plan kodlama ajanı başına tipik hata düzeltme maliyeti (Nisan 2026)"
"Görev başına USD""Tipik hata düzeltmesi"
"Jules (ücretsiz katman)"0
"Codex Cloud"0.6
"Cursor BG"0.9
"Claude Code Remote"1.2
"Copilot CA (Pro premium istek)"0.12
"Devin"5.6
"Factory Droids"0

Tipik 2-3 ACU / token eşdeğeri hata düzeltme görevi için tahminler. Gerçek maliyet model seçimi ve bağlam uzunluğuyla değişir. Ücretsiz katman ve koltuk bazlı araçlar $0 marjinal maliyet gösteriyor.

Bu rakamları çalıştırmanın dersi şu: Devin, token faturalandırmalı rakiplere kıyasla görev başına 5-10 kat daha pahalı. Bu prim özerklik satın alıyor — yazılacak daha az prompt, daha az görev ortası elden tutma — ama rutin hata düzeltmelerinde Codex veya Cursor ham maliyette kazanıyor.

Hangi arka plan kodlama ajanının benchmark skorları en iyi?

Anthropic'in Claude Opus 4.7'si SWE-bench Verified'da %87,6 ile lider; Codex'in gpt-5-codex'i %77-80 civarında. Codex, Terminal-Bench 2.0'da %77,3 ile lider. Ancak benchmark'lar, altta yatan modelin neler yapabileceğini ölçüyor — gerçek dünya başarı oranınız, model kadar ajan çerçevesine, sandbox'a ve prompta da bağlı.

AraçTemel modelSWE-bench VerifiedTerminal-Bench 2.0Notlar
Claude Code RemoteClaude Opus 4.7%87,6yok (değişken)En yüksek Verified skoru
Codex Cloudgpt-5-codex~%77-80%77,3Terminal-Bench lideri
DevinCognition stack (karma)Junior-SWE'de kendi bildirimi güçlüyokJunior-SWE geçiş oranı bildiriyor, Verified değil
Cursor BGKullanıcı seçimli frontiermodel skorunu miras alırmiras alırSkor hangi modeli seçtiğinize bağlı
Copilot CAGPT/Claude (kademeli)miras alırmiras alırKademelere göre kilitli model seçimi
JulesGemini 2.5/3resmi olarak bildirilmemişresmi olarak bildirilmemişDaha az benchmark şeffaflığı
Factory DroidsÇoklu model yönlendirmeDroid başına miras alırmiras alırFarklı Droids farklı modeller kullanıyor

Toplu bir görünüm için artificialanalysis.ai'nin kodlama ajanları matrisi, sağlayıcılar genelinde dönen benchmark rakamlarını izliyor.

Benchmark'lar tavan değil, taban. Aynı ticket'ta Cursor BG ile Opus 4.7'nin Devin'i geçtiğini gördük — çerçeve önemli. Satın almak yerine kendi ajan çerçevenizi kuruyorsanız, model skoru ile gerçek dünya başarı oranı arasındaki farkı doğuran çerçeve seçimlerini LangGraph vs CrewAI vs OpenAI Agents SDK karşılaştırmamız ele alıyor.

Arka plan kodlama ajanlarına tam repo erişimi vermek güvenli mi?

Her araç farklı izole eder. Devin tam sandbox VM çalıştırır. Codex OpenAI yönetimli bulut sandbox kullanır. Cursor geçici uzak makineler başlatır. Copilot GitHub yönetimli runner'lar kullanır (mevcut GitHub Actions güvenlik modeliniz geçerli). Claude Code Remote Anthropic'in bulutunda çalışır. Factory bulut veya hava boşluklu yerel sunar. Hiçbiri "prod'da root ver" değil.

AraçÇalışma ortamıAğ çıkışıKalıcı durumHava boşluklu seçenek
DevinTam sandbox VM (kendi IDE+tarayıcısı)Evet, kapsamlıOturum başınaHayır
Cursor BGGeçici bulut VMEvetHayırHayır
Codex CloudOpenAI bulut sandboxEvet, kapsamlıHayırHayır
Claude Code RemoteAnthropic bulutuEvet, kapsamlıKalıcı ajan oturumlarıHayır
Copilot CAGitHub yönetimli runnerActions yapılandırmasını miras alırÇalıştırma başınaYalnızca Enterprise
JulesGoogle bulut VMEvetGörev başınaHayır
Factory DroidsBulut VEYA yerelYapılandırılabilirYapılandırılabilirEvet

Benimsemeden önce CTO düzeyinde sorulacak sorular

Bu ajanlardan herhangi birine repo erişimi vermeden önce, dört soru politikayı belirler:

  1. Repo izinleri — ajan main'e yazma erişimi alıyor mu, yoksa feature branch'lerle kilitli mi? Her zaman feature branch'lere plus zorunlu PR incelemesiyle kilitli tutun.
  2. Secret erişimi — ajan .env dosyalarını okuyabilir mi ya da secret manager'ınızı çağırabilir mi? Varsayılan-red ve kapsamlı token'lar kullanın.
  3. Ağ çıkışı — sandbox neye çağrı yapabiliyor? Paket kayıt defterleri ve özel ayna için allowlist ile varsayılan-red ağ kullanın.
  4. Denetim günlüğü saklama — ajan oturumları ne kadar süre saklanıyor ve güvenlik ekibiniz bunları sorgulayabilir mi? İzin vermeden önce bunu yazılı olarak sabitleyin.

Arka plan kodlama ajanları kodumu eğitim için kullanıyor mu?

Varsayılan opt-in/opt-out değişiyor. OpenAI Codex enterprise planları, varsayılan olarak kodunuzu eğitim için kullanmıyor. Anthropic Claude Code kodunuzu eğitim için kullanmıyor. GitHub Copilot Business ve Enterprise veri hariç tutmaya sahip. Cursor gizlilik modu sunuyor. Devin, kodun müşteri kontrolünde kaldığını belirtiyor. Repo erişimi vermeden önce her zaman satıcının dokümanlarındaki güncel veri kullanım politikasını doğrulayın.

Her araç için tek satır, mevcut varsayılan davranışla:

  • Devin — kod, Cognition'ın politikasına göre müşteri kontrolünde kalıyor
  • Cursor — gizlilik modu geçiş düğmesi, her türlü eğitim için opt-in
  • Codex Cloud — enterprise varsayılan eğitim yok; ChatGPT Plus tüketici şartlarına tabi
  • Claude Code Remote — Anthropic'in ticari şartları uyarınca kodunuzu eğitim için kullanmıyor
  • Copilot Business/Enterprise — veri hariç tutma varsayılan açık; Pro/Pro+ ayrı geçiş düğmesine sahip
  • Jules — Google'ın standart enterprise veri şartları geçerli; güncel politikayı doğrulayın
  • Factory Droids — dokümanlarına göre müşteri kontrolünde; hava boşluklu yerel soruyu ortadan kaldırıyor

Politikalar 2025-26'da birkaç kez değişti. Erişim vermeden önce yeniden kontrol edin — satıcılar şartları blog yazılarının güncellendiğinden daha sık güncelliyor. Bir arka plan ajanının PR'ı oluştuktan sonra, birleştirmeden önce yapılandırılmış bir yapay zeka kod inceleme geçişi isteyeceksiniz — ajan satıcısı bunu halletttiği için IP sorusu ortadan kalkmıyor.

Techsy'nin müşteri projelerinde arka plan ajanları nasıl seçtiği

Techsy müşteri projelerinde tek araç seçmek yerine katmanlı bir yığın çalıştırıyoruz. Cursor Background Agents, IDE içi async çalışmayı üstleniyor (zaten Cursor'da yaşıyorlar). Claude Code Remote Tasks, zamanlanmış cron tarzı görevleri yürütüyor — haftalık bağımlılık güncelemeleri, gecelik QA geçişleri, otomatikleştirilmesi gereken sıkıcı iş. Codex Cloud, lint ve bağımlılık güncellemelerinde benchmark skorlarından hızın önemli olduğu token-ucuz verim için. Devin'i, tam delege özerkliği gerektiren ve iyi tanımlanmış backlog'a sahip müşteriler için seçiyoruz.

Pek kullanmadığımız: Copilot Coding Agent. Pro'daki premium istek bütçesi, kullanım düzeyimizde alternatiflerden daha hızlı tükeniyor ve yükseltmeyi haklı kılacak kadar Enterprise müşterimiz henüz yok. Enterprise dağıtımı için tek bir satıcıya kilitlenmeden önce LangGraph veya OpenAI Agents SDK ile özel bir çerçeve kurardık — ama sıfırdan müşteri çalışmasının %80'inde, hazır araçlar kendiniz geliştirmekten daha hızlı. Kullandığımız ajansal AI deployment platformu, bu araçların üretimde ürettiği ajanları yönetiyor.

Bu araçlardan hangisinin yığınınıza uyduğu veya özel bir ajan çerçevesi hakkında ücretsiz danışmanlık almak isterseniz, kapsamını çıkarmaktan memnuniyet duyarız.

SSS — Arka Plan Kodlama Ajanları Karşılaştırması

Arka plan kodlama ajanı nedir?

Arka plan kodlama ajanı, sandbox'lı bir bulut ortamında asenkron çalışan bir yapay zeka yazılım mühendisidir. Bir görev atarsınız — GitHub issue'su, Linear ticket'ı veya Slack mesajı — ve ajan dakikalarca ya da saatlerce tek başına çalışır, ardından incelemeniz için bir pull request döndürür. Temel özellik, yazarken izlemenize gerek olmaması; siz başka bir yerdeyken çalışıyor.

Arka plan kodlama ajanı ile Cursor veya Copilot satır içi arasındaki fark nedir?

Arka plan ajanları, bir bulut sandbox'ında async çalışır ve pull request döndürür. Cursor ve Copilot gibi satır içi araçlar, editörünüzde siz yazarken, her tuşa siz basarken kod önerir. Arka plan ajanları paralelliği mümkün kılar (5 görevi kuyruğa al, 5 PR al); satır içi araçlar, üzerinde odaklandığınız tek bir görevde hızlı yinelemeyi sağlar.

Arka plan kodlama ajanları görev başına ne kadar maliyetli?

Devin, tipik bir hata düzeltmesi için 2-3 ACU ile $4,50-6,75 alıyor. Cursor ve Codex Cloud, token tüketimine göre faturalandırıyor; model ve bağlam uzunluğuna bağlı olarak görev başına genellikle $0,30-3. Jules, günde 15 göreve kadar ücretsiz. Copilot Coding Agent, Pro katmanında yaklaşık $0,04 birim fiyatıyla premium istekler kullanıyor — ücretli planlar arasında görev başına en ucuz seçenek.

Solo geliştiriciler için hangi arka plan kodlama ajanı en ucuz?

Google Jules'ün ücretsiz katmanı eşsiz: $0/ay ile günde 15 görev ve 3 eşzamanlı ajan. Bunu aşarsanız, $20/ay dahil $20 kullanımla Cursor Pro, bonus olarak editör entegrasyonu sunuyor. Çoğu solo geliştirici için Jules hiç ödeme yapmadan günlük ihtiyaçları karşılıyor.

Arka plan kodlama ajanlarına tam repo erişimi vermek güvenli mi?

Evet, ama çekincelerle. Kapsamlı token'lar kullanın (kişisel erişim token'ınızı değil), allowlist ile varsayılan-red ağ çıkışı, ajanı zorunlu PR incelemesiyle feature branch'lere kilitleyin ve denetim günlüklerini haftada bir gözden geçirin. Bu ajanların hiçbirine prodüksiyon yazma izni vermeyin. Ajanı bir yüklenici gibi ele alın: güven, ama her PR'ı doğrulayın.

Arka plan kodlama ajanları kodumu eğitim için kullanıyor mu?

Anthropic Claude Code, OpenAI Codex enterprise planları ve GitHub Copilot Business/Enterprise, kodunuzu eğitim için varsayılan olarak kullanmıyor. Cursor gizlilik modu sunuyor. Devin, kodun müşteri kontrolünde kaldığını belirtiyor. Repo erişimi vermeden önce her zaman satıcının dokümanlarındaki güncel veri kullanım politikasını doğrulayın — politikalar 2025-26'da birkaç kez değişti.

Bir arka plan kodlama ajanı kendi pull request'ini birleştirebilir mi?

İzin verirseniz çoğu yapabilir, ama tanıdığımız her ekip birleştirmeden önce insan incelemesi istiyor. Teknik kapasite var — Copilot, Devin ve Cursor, branch koruması izin verirse otomatik birleştirme yapabilir — ama otomatik birleştirme bir tuzak. PR inceleme kapısı, bir ajanın hatasının üretime girmeden önceki son ucuz güvenlik ağı.

Enterprise ekipler için en iyi arka plan kodlama ajanı hangisi?

Ortamınıza bağlı iki yanıt var. GitHub Enterprise'a derinden entegre olduysanız, Copilot Coding Agent en düşük sürtünmeli seçim — issue ataması iş akışı, ekstra araç gerekmez. Yönetişim, uyumluluk veya hava boşluklu gereksinimleriniz varsa, Factory Droids, yerel çalıştırma ve kod, test, inceleme, deploy üzerinde çok ajanlı koordinasyonlu tek seçenek.

Hangi arka plan kodlama ajanının en iyi ücretsiz katmanı var?

Google Jules tartışmasız kazanıyor. Günde 15 görev, 3 eşzamanlı ajan, tam Gemini erişimi — $0/ay, zaman sınırı yok. Copilot'un Ücretsiz katmanı (aylık 50 premium istek) uzak bir ikinci; Cursor'un Hobby katmanı teknik olarak ücretsiz ama arka plan ajanı kullanımını anlamlı biçimde karşılamıyor. Jules, solo çalışmada ücretli bir planın yerini tuttuğunu gördüğümüz tek ücretsiz katman.

Ne zaman arka plan ajanı, ne zaman Cursor gibi satır içi yapay zeka kullanmalıyım?

Görev iyi tanımlıysa, 15 dakikadan uzun sürüyorsa ve düzenleme ortasında yön değiştirmenize gerek kalmayacaksa arka plan ajanı kullanın — bağımlılık yükseltmeleri, tekrarlayan yeniden düzenlemeler, çok dosyalı geçişler ya da net bir ticket olarak tanımlayabileceğiniz her şey. Prototip yapıyorsanız, keşfediyorsanız ya da yeni bir çalışmada modelle pair-programming yapıyorsanız satır içi kullanın.

Özet

  • Delege edecekseniz Devin, Cursor'da yaşıyorsanız Cursor BG, ChatGPT Pro kullanıcısıysanız Codex Cloud, benchmark için Claude Code Remote, GitHub-native için Copilot, ücretsiz katman için Jules, uyumluluk için Factory.
  • Fiyat dalgalanması gerçek — Nisan 2026'daki Devin indirimi, Codex token reformu ve Copilot kayıt duraklaması hepsi bu ay gerçekleşti. Satın almadan önce doğrulayın.
  • Async kategori bir yaşında ve hızla gelişiyor. Bu matrisin yazın yeniden değişmesini bekleyin.

Yığınınıza hangi arka plan ajanının uyduğunu seçmek veya bir ajan çerçevesi kurmak için yardım ister misiniz? Ücretsiz danışmanlık alın.

Etiketler

arka-plan-kodlama-ajanlaridevincursorcodexclaude-codeyapay-zeka-gelistirmellm-tooling

Bu makaleyi paylaş

Projenize Başlayın

Harika bir şey inşa etmeye hazır mısınız?

Vizyonunuzu hayata geçirelim. Fark yaratan yazılımlar için ekibimiz hazır.