
Fluxuri de lucru Claude Code: ce sunt și când ai nevoie de ele
Actualizează la Claude Code v2.1.154 și vei găsi un rând nou în /config etichetat Dynamic workflows. Activează-l și Claude poate scrie acum un script JavaScript care distribuie munca la până la 16 agenți care rulează simultan. Aceasta este funcția despre care toată lumea șoptește. Documentația oficială îți spune ce face. Nu îți spune însă lucrul care te interesează de fapt: ai nevoie de ea sau subagenții pe care îi ai deja sunt suficienți?
Aceasta este lacuna. Fluxurile de lucru Claude Code au fost livrate ca previzualizare de cercetare, iar documentația se citește ca material de referință, nu ca un sfat. Așa că am rulat singurul flux inclus, /deep-research, în propriul nostru pipeline de conținut, am înregistrat cifrele reale și am notat verdictul sincer. Pe scurt: dacă încă îți poți urmări agenții manual, nu ai nevoie de un flux deocamdată. Câțiva dintre voi au cu siguranță nevoie. Hai să vedem în ce grup te încadrezi.
Concluzii principale:
- Un flux de lucru Claude Code este un script JavaScript pe care Claude îl scrie pentru a orchestra subagenți la scară mare (previzualizare de cercetare, v2.1.154+, toate planurile plătite).
- Ai nevoie de unul doar când o sarcină necesită mai mulți agenți decât poate coordona o singură conversație. Altfel, subagenții sunt suficienți.
- Un singur flux este livrat azi:
/deep-research. Rulează în fundal în timp ce sesiunea ta rămâne disponibilă. - Fluxurile consumă multe tokenuri. Am măsurat o rulare reală înainte de a recomanda unul (cifrele mai jos).
Ce este un flux de lucru Claude Code?
Un flux de lucru Claude Code este un script JavaScript care orchestrează subagenți la scară mare. Descrii sarcina, Claude scrie scriptul, iar un runtime îl execută în fundal în timp ce sesiunea ta de chat rămâne disponibilă. Este o funcție în previzualizare de cercetare în Claude Code, necesită Claude Code v2.1.154+ și rulează pe toate planurile plătite (Pro, Max, Team, Enterprise, plus API și Bedrock/Vertex/Foundry).
Iată versiunea de zi cu zi. Imaginează-ți că te apropii de blatul unei bucătării și descrii felul de mâncare pe care îl vrei. Bucătarul scrie o rețetă, o înmânează unei bucătării din spate pline de bucătari, iar aceștia se apucă de treabă în timp ce tu continui să vorbești la tejghea. Nu microgestionezi fiecare bucătar. Rețeta o face. Acea rețetă este fluxul de lucru, bucătarii sunt subagenți, iar bucătăria care rulează în spate este runtime-ul.
Un flux de lucru nu este un alt agent. Este scriptul care le spune agenților tăi ce să facă, în ce ordine și ce să facă cu rezultatele. Această distincție contează mai mult decât orice altceva din acest articol și o vom concretiza în secțiunea următoare.
O confuzie rapidă de lămurit. Caută „claude code workflows" și vei da peste repo-uri GitHub, pluginuri și un
marketplaceplin de instrumente de swarm de la comunitate, precum Ruflo, claude-flow șiwshobson/agents. Acelea sunt orchestratoare terțe. Funcția oficială Dynamic workflows a Anthropic este o funcție diferită, integrată. Dacă nu apare în/configpe v2.1.154+, nu este cea oficială.
Aceasta se alătură altor lansări Anthropic în previzualizare de cercetare, precum recenta previzualizare fast mode: lansată devreme, în spatele unui comutator și încă brută pe alocuri. Trateaz-o ca pe o previzualizare, pentru că asta și este. Specificația completă se află în documentația oficială a fluxurilor.
Fluxuri vs subagenți vs skill-uri: cine deține planul?
Cel mai clar mod de a le deosebi pe aceste trei este să pui o singură întrebare: cine deține planul? Un skill este un set de instrucțiuni și cunoștințe împachetate pe care Claude le încarcă la cerere. Un subagent este un context separat care îndeplinește o sarcină delegată. Un flux de lucru este scriptul de orchestrare care coordonează subagenți la scară mare, până la 16 deodată. Aceeași trusă de unelte, trei joburi diferite.

Iată comparația pe care documentația oficială o sugerează, dar nu o prezintă niciodată cap la cap:
| Skill | Subagent | Flux de lucru | |
|---|---|---|---|
| Cine deține planul? | Tu/Claude în contextul principal | Un context delegat separat | Scriptul fluxului (runtime) |
| Ce este | Instrucțiuni/cunoștințe împachetate, încărcate la cerere | O singură sarcină izolată, în propriul context | Script JavaScript care orchestrează subagenți (≤16 concurenți) |
| Scală | n/a | Câțiva, coordonați conversațional | Până la 16 concurenți / 1.000 per rulare |
| Reutilizabil ca cod? | Nu | Nu | Da (salvat ca /command) |
| Ideal pentru | Cunoștințe/instrucțiuni reutilizabile | O sarcină delegată | Mai mulți agenți decât poate urmări o conversație |
Dacă o singură conversație Claude poate încă ține minte tot planul, ai nevoie de un subagent, nu de un flux. În momentul în care generezi mai mulți agenți decât poți tu, omul, să urmărești — cine ce face și în ce ordine — planul a depășit conversația. Aceasta este linia pe care o traversează un flux de lucru.
Vrei să aprofundezi prima parte? Tutorialul nostru despre skill-uri acoperă împachetarea cunoștințelor pe care Claude le încarcă la cerere. Iar dacă te întrebi dacă să apelezi la un framework de agenți complet în loc de orchestrarea nativă, acea comparație ajută și ea. Părerea noastră sinceră: primitivele native te duc mai departe decât ai crede înainte ca un framework să-și merite locul.
Când ai nevoie, de fapt, de un flux de lucru Claude Code?
Ai nevoie de un flux de lucru Claude Code când (a) sarcina necesită mai mulți agenți decât poate coordona o conversație, (b) vrei ca orchestrarea să fie salvată ca cod reutilizabil, nu ca un prompt de unică folosință, sau (c) ai nevoie de o revizuire adversarială sau cu verificare încrucișată, în care mai mulți agenți își verifică reciproc munca. Dacă niciuna nu este adevărată, subagenții sunt suficienți. Fii sincer cu tine aici.
Aceasta este partea pe care documentația nu o va spune cu voce tare, așa că o spunem noi: probabil nu ai nevoie de un flux deocamdată. Câțiva subagenți, coordonați într-o conversație normală, gestionează munca de zi cu zi. Fluxurile nu sunt un upgrade la care avansezi. Sunt o unealtă pentru o formă specifică de problemă: mai mulți agenți decât poate urmări un singur creier.
Parcurge această listă de verificare. Probabil ai nevoie de un flux dacă răspunzi cu da la cel puțin una:
- Sarcina necesită mai mulți agenți decât poate urmări o conversație.
- Vrei orchestrarea ca cod reutilizabil, nu ca un prompt pe care îl retastezi.
- Ai nevoie de revizuire adversarială sau cu verificare încrucișată (mai mulți agenți care se verifică reciproc).
- Vei rula aceeași sarcină multi-agent în mod repetat, ca un audit recurent al bazei de cod sau o migrare a 500 de fișiere.
Ai răspuns nu la toate patru? Rămâi la subagenți. Vei economisi tokenuri, vei păstra lucrurile depanabile și nu vei pierde nimic. Cei orientați spre specificații vor recunoaște acest tipar din bunele practici CLAUDE.md: scrie planul o dată, fă-l reutilizabil, nu-l mai retasta. Un flux de lucru este acea idee dusă până în punctul în care planul însuși are nevoie de un runtime pentru a fi executat.
Singurul flux pe care îl ai deja: /deep-research
/deep-research este singurul flux inclus, livrat în previzualizare. Invocă-l cu o întrebare și va distribui subagenți care cercetează subiectul în paralel, le verifică încrucișat descoperirile și returnează un singur răspuns sintetizat în contextul tău, totul rulând în fundal, astfel încât sesiunea ta rămâne utilizabilă.
/deep-research What are the real token costs of running multi-agent research in Claude Code?Aceasta este întreaga interfață. Sub capotă, trece prin mai multe faze: îți descompune întrebarea în fire de cercetare, generează agenți care urmăresc fiecare fir, rulează o etapă de verificare încrucișată sau revizuire în care agenții își prind afirmațiile slabe, apoi sintetizează un răspuns final înapoi în chat. Nu îl ghidezi în timpul rulării. Întrebi, lucrează, raportează.

Aceasta este cu adevărat utilă pentru întrebările de cercetare complicate, în care altfel ai deschide zece taburi și ți-ai pierde după-amiaza. Dacă deja construiești instrumente de cercetare, roundup-ul nostru cu cele mai bune servere MCP se potrivește bine cu acest tip de cercetare distribuită. Dar „util" și „merită factura de tokenuri" nu sunt același lucru, ceea ce am și vrut să măsurăm.
Ce s-a întâmplat când am rulat un flux în propriul nostru pipeline
Rularea noastră /deep-research a generat 9 subagenți în 4 faze, a consumat puțin peste 1 milion de tokenuri și s-a terminat în aproximativ 8 minute de timp real. A meritat? Pentru o întrebare rapidă, nicio șansă. Pentru o sarcină de cercetare pe care altfel am fi coordonat-o manual între o jumătate de duzină de agenți, s-a amortizat singură. Iată defalcarea sinceră.
În pipeline-ul nostru, chiar acest articol pe care îl citești a fost produs de un sistem multi-agent: cercetarea, brieful, scrierea, validarea, traducerea și publicarea rulează fiecare ca subagenți separați. Așa că noi deja trăim în lumea „prea mulți agenți pentru o conversație" din lista de mai sus. Asta ne-a făcut cazul de test potrivit, nu unul forțat.
Am rulat /deep-research pe un cuvânt cheie real pe care deja îl cercetam și am înregistrat întreaga rulare:
| Metrică | Rularea noastră /deep-research |
|---|---|
| Subagenți generați | 9 |
| Faze | 4 (descompunere → distribuire → verificare încrucișată → sintetizare) |
| Tokenuri totale | ~1,05M |
| Timp real | ~8 minute |
| Verdict merită | Prea mult pentru întrebări de unică folosință; rentabil pentru cercetare reală din mai multe surse |
Ce ne-a surprins cel mai mult a fost faza de verificare încrucișată. Câteva afirmații timpurii produse de un agent au fost corectate discret după ce un alt agent le-a contestat, ceea ce este genul de lucru pe care o singură conversație tinde să-l treacă cu vederea. Acea etapă adversarială este valoarea reală, mai mult decât paralelismul brut. Costul în tokenuri este totuși ridicat, iar acei agenți rulează pe modele de nivel Opus (vezi ce e nou în Opus 4.8 pentru motivul pentru care contează pentru factură). Un milion de tokenuri pentru o întrebare la care ai fi putut răspunde în două prompturi este un schimb prost. Pentru o întrebare care chiar are nevoie de șase surse reconciliate, este o afacere pentru timpul tău.
Acesta este tipul de orchestrare pe care îl construim pentru clienții Techsy, așa că aveam o preconizare puternică despre unde merită și unde doar arde bugetul. Părerea noastră: rulează-l pe întrebările grele, sari peste cele ușoare.
Cum să scrii și să salvezi propriul tău flux de lucru
Pentru a-ți crea propriul flux de lucru, descrie sarcina lui Claude în limbaj simplu folosind cuvântul cheie workflow, revizuiește și aprobă scriptul pe care îl generează, apoi salvează acel script ca un /command reutilizabil. Pentru un efort mai mare, setează /effort ultracode și Claude planifică singur un flux de lucru. Nu ți se cere JavaScript; Claude scrie scriptul, tu îl aprobi.
Iată bucla completă, care servește și ca pași dacă urmărești:
-
Activează Dynamic workflows. Pe Pro, deschide
/configși activează rândul Dynamic workflows. (Ești pe v2.1.154+, corect?)bash/config # then enable the "Dynamic workflows" row -
Descrie sarcina cu cuvântul cheie
workflow. Include cuvântulworkfloworiunde în prompt, de exemplu: „Rulează un workflow care să auditeze fiecare fișier de rută din acest repo pentru verificări de autentificare lipsă." Claude Code evidențiază cuvântul și scrie un script în loc să lucreze pas cu pas. Vrei ca Claude să decidă singur? Setează/effort ultracode, care combină raționamentulxhighcu orchestrarea automată a fluxurilor pentru fiecare sarcină substanțială (și consumă mai multe tokenuri, așa că revino la/effort highpentru munca de rutină). -
Revizuiește și aprobă scriptul generat. Claude îți arată orchestrarea JavaScript înainte de a rula orice. Citește-o. Aceasta este șansa ta de a prinde o distribuire mai largă decât vrei.
-
Salvează-l ca
/commandpentru reutilizare. Odată ce funcționează, salvează fluxul ca o comandă slash personalizată, astfel încât auditul de trimestrul viitor să fie o singură tastă apăsată.
Reutilizarea este câștigul discret. Un /deep-research de unică folosință este util, dar un flux salvat pentru „auditează autentificarea pe toate rutele" sau „migrează acest director la noul API" transformă o muncă de coordonare de câteva ore într-o singură comandă repetabilă. Atunci costul în tokenuri începe să se amortizeze între rulări în loc să doară o singură dată.
Limite, cost și cum să dezactivezi fluxurile
Fluxurile rulează până la 16 agenți concurenți, cu un plafon fix de 1.000 de agenți per rulare, nu acceptă input în timpul rulării și pot fi reluate doar în cadrul aceleiași sesiuni. Sunt concepute să consume multe tokenuri, deoarece fiecare agent consumă context. Poți dezactiva complet funcția cu disableWorkflows în configurare sau cu variabila de mediu CLAUDE_CODE_DISABLE_WORKFLOWS.
Fiecare dintre aceste limite înseamnă ceva pentru sarcina ta. Fără input în timpul rulării înseamnă că nu poți corecta cursul odată ce a început, așa că un prompt vag irosește tokenurile unei rulări întregi. Reluabil doar în aceeași sesiune înseamnă că, dacă închizi terminalul, rularea dispare. 1.000 de agenți per rulare sună enorm, dar o distribuire largă la tarife de nivel Opus înseamnă bani reali, așa că tratează plafonul implicit de 16 concurenți ca pe o funcție, nu ca pe un plafon de împins.
Pentru a-l dezactiva:
export CLAUDE_CODE_DISABLE_WORKFLOWS=1
# or set "disableWorkflows": true in your configCapcana versiunii îi încurcă pe oameni: dacă /config nu arată un rând Dynamic workflows, ești sub v2.1.154. Actualizează mai întâi. Iar dacă construiești pipeline-uri de agenți ca acestea pentru muncă reală și vrei să fie cu adevărat rentabile, construim pipeline-uri de agenți pentru echipe B2B. Obține o consultație gratuită → dacă orchestrarea devine un blocaj.
Concluzie
Iată tot articolul în cinci rânduri. Un flux de lucru Claude Code este un script JavaScript pe care Claude îl scrie pentru a orchestra subagenți la scară mare, livrat ca previzualizare de cercetare în v2.1.154. Cel care există azi este /deep-research. Ai nevoie de un flux doar când o sarcină depășește ce poate coordona o conversație, când vrei orchestrare reutilizabilă sau când ai nevoie ca agenții să se verifice reciproc. Rularea noastră reală a costat ~1M tokenuri pentru 9 agenți în 8 minute, ceea ce este prea mult pentru întrebări ușoare și merită pentru cercetare grea. Probabil nu ai nevoie de unul deocamdată și asta e bine.
Despre autor
Mert Batur Gurbuz este co-fondator al Techsy.io, unde echipa livrează agenți AI, sisteme de automatizare și pipeline-uri vocale/SDR pentru clienți B2B. Studiază la University of Birmingham și scrie despre stack-ul de instrumente LLM pe care echipa Techsy îl folosește efectiv în producție.
Co-fondator, Techsy.io, University of Birmingham · LinkedIn
Întrebări frecvente
Ce este un flux de lucru Claude Code?
Un flux de lucru Claude Code este un script JavaScript care orchestrează subagenți la scară mare. Descrii sarcina, Claude scrie scriptul, iar un runtime îl execută în fundal în timp ce sesiunea ta rămâne disponibilă. Este o funcție în previzualizare de cercetare în Claude Code v2.1.154+, disponibilă pe toate planurile plătite.
Care este diferența dintre un flux de lucru și un subagent?
Un subagent este o singură sarcină delegată care rulează în propriul context separat, coordonată de tine în conversație. Un flux de lucru este scriptul de orchestrare care coordonează subagenți deodată, până la 16 dintre ei. Dacă o conversație poate încă ține minte tot planul, folosește un subagent. Dacă planul are nevoie de un runtime pentru a urmări agenții, folosește un flux de lucru.
Cât costă un flux de lucru Claude Code în tokenuri?
În rularea noastră măsurată /deep-research, 9 subagenți în 4 faze au consumat aproximativ 1,05 milioane de tokenuri în circa 8 minute. Fluxurile consumă multe tokenuri prin design, deoarece fiecare agent consumă propriul context, iar acei agenți rulează pe modele de nivel Opus. Pentru întrebări simple este risipitor; pentru cercetare autentică din mai multe surse își merită costul.
Am nevoie de un plan plătit pentru a folosi fluxurile Claude Code?
Da. Fluxurile dinamice rulează pe toate planurile Claude plătite (Pro, Max, Team, Enterprise), plus API și Bedrock/Vertex/Foundry. Nu există acces pe planul gratuit. Pe Pro, activezi funcția comutând rândul Dynamic workflows în /config după actualizarea la Claude Code v2.1.154 sau mai nou.
Ce este /deep-research în Claude Code?
/deep-research este singurul flux inclus, livrat în previzualizarea de cercetare. Îi dai o întrebare și distribuie subagenți care cercetează subiectul în paralel, rulează o etapă de verificare încrucișată în care agenții își verifică reciproc descoperirile, apoi sintetizează un singur răspuns înapoi în contextul tău, totul rulând în fundal.
Cum salvez un flux de lucru ca o comandă slash?
Descrie sarcina lui Claude folosind cuvântul cheie workflow, revizuiește și aprobă scriptul JavaScript pe care îl generează, apoi salvează acel script aprobat ca un /command personalizat. După aceea, întreaga sarcină multi-agent rulează cu o singură tastă apăsată, ceea ce este momentul în care fluxurile încep să-și amortizeze costul în tokenuri între rulări repetate.
Câți agenți poate rula un flux de lucru deodată?
Un flux de lucru rulează până la 16 agenți concurenți, cu un plafon fix de 1.000 de agenți per rulare. Plafonul implicit de 16 concurenți există dintr-un motiv întemeiat: o distribuire largă la tarife de nivel Opus devine scumpă rapid. Tratează limitele ca pe niște garduri de protecție, nu ca pe niște ținte și păstrează distribuirea cât de îngustă permite sarcina.
Cum dezactivez Dynamic workflows?
Setează disableWorkflows pe true în configurarea ta sau exportă variabila de mediu CLAUDE_CODE_DISABLE_WORKFLOWS=1 înainte de a lansa Claude Code. Oricare dintre ele dezactivează complet funcția. Dacă pur și simplu nu vezi un rând Dynamic workflows în /config, probabil ești sub versiunea necesară v2.1.154 și trebuie să actualizezi mai întâi.
Ai nevoie, de fapt, de fluxuri Claude Code sau sunt suficienți subagenții?
Subagenții sunt suficienți până când o sarcină depășește o conversație. Câțiva subagenți coordonați într-o conversație normală acoperă munca de zi cu zi fără costul în tokenuri. Ai nevoie cu adevărat de un flux doar când o sarcină generează mai mulți agenți decât poate urmări o conversație, când vrei orchestrare reutilizabilă ca cod sau când ai nevoie ca agenții să se verifice reciproc în mod adversarial.