
Claude Cowork-alternativ: hvorfor regulerte bedrifter bygger sin egen AI-coworker-stack (2026)
Har du lest vår fullstendige Cowork-guide og magefølelsen sier at den ikke kan røre dine mest sensitive arbeidsflyter, har du sannsynligvis rett. Claude Cowork passer briljant til arbeidet den er designet for — og passer dårlig til det regulerte, skreddersydde og suverenitetsbundne arbeidet som fyller bedriftskalenderne. Her er den ærlige analysen, referansearkitekturen og TCO-regnestykket.
Der Claude Cowork virkelig blinker
Cowork er riktig svar når arbeidet ditt er på ikke-sensitiv data, teamet ditt er mellom 5 og 500 personer og du heller vil i gang på to uker enn to kvartaler. Anthropic har spikret AI-coworker-UX-en for det publikummet, og de fire vertikale pakkene som er levert de siste seks ukene viser at de investerer i den som langsiktig produkt, ikke som sideprosjekt.
Tre Cowork-sweet-spots er godt dokumentert i klyngen vår:
- Markedsoperasjoner — innholdsbriefer, målgruppeundersøkelser, flerkanals-orkestrering. Coworks plugin-markedsplass og planleggings-primitiver passer rent på hvordan markedsteam faktisk jobber. Se vår marketing ops-analyse for arbeidsflytmønstrene.
- Juridiske team — kontrakttriagering, redline-gjennomgang, jurisdiksjonsforskning. Legal-pakken Anthropic leverte 12. mai var første vertikale pakke og er fremdeles den mest polerte. Vi gjennomgår bruksområdene i vår analyse for juridiske team.
- Små og mellomstore bedrifter — fakturering, kundeoppfølging, lett rapportering. SMB-pakken (13. mai) er virkelig god for bedrifter under ~250 ansatte uten en CISO i nakken. Vår SMB-anmeldelse går i detalj.
Anthropic bekreftet også at Finansielle Tjenester er neste vertikale pakke, og Managed Agents-stacken annonsert på Code w/ Claude 11. mai hever taket for hva Coworks plugin-markedsplass kan gjøre. Ingenting av dette er omstridt.
Cowork er riktig svar for de fleste bedrifter mesteparten av tiden. Denne artikkelen handler om resten — den regulerte, suverenitetsbundne, IP-tunge minoriteten der Cowork er feil verktøy, selv om det er et glimrende produkt.
De 8 bedriftsscenarioene der Cowork treffer grensen
Åtte arbeidsflyter skiller "Cowork duger" fra "Cowork er umulig": GDPR-dataplassering, PHI i helse, klassifisert forsvar/myndigheter, M&A-deal-room-konfidensialitet, regulert finans under SEC/FINRA, beskyttelse av egen IP, bredde i skreddersydde MCP-servere utover Anthropics ~20, og agentorkestreringsmønstre Anthropic ikke har designet for. Hver av disse er en ja/nei-port, ikke en preferanse.
| Scenario | Hvorfor Cowork ikke holder | Hva selvhostet gir deg |
|---|---|---|
| GDPR-dataplassering | Cowork Enterprise tilbyr EU-dataplassering, men ikke full single-region-pinning for alle underleverandører og modellveier. Grensekryssende telemetri er vanskelig å revidere. | Region-pinnet inferens (Bedrock EU, Vertex EU, on-prem) pluss full DLP på hvert lag; underleverandørlisten er din egen. |
| PHI i helse | Anthropics BAA dekker modellendepunktet, ikke kundens nedstrøms verktøykall eller tredjepartsplugins fra markedsplassen. Plugin-spredning bryter HIPAA-omfanget. | Full PHI-segregering via tenant-isolert infra, hver MCP-server revidert mot ditt BAA, prompter og svar logget med oppbevaringskontroller du setter. |
| Forsvar / myndigheter klassifisert | ITAR, IL5/IL6 og tilsvarende krever sovereign-cloud eller on-prem-deployment. Cowork er SaaS. | vLLM eller selvhostet Llama 3.3 på GovCloud, IL5-akkreditert eller on-prem-maskinvare. Anthropics closed-weight-modeller kan ikke kjøres her. |
| M&A-deal-room-konfidensialitet | Prompter som beskriver dealvilkår kan aldri forlate deal-room-VPC-en. Coworks markedsplass-plugins og globale minne-funksjoner er strukturelt inkompatible. | Hermetisk per-deal-stack på efemær infrastruktur som slettes ved dealavslutning. Null delt minne mellom dealer. |
| Regulert finans (SEC, FINRA) | SEC AI Disclosure Rule 2025 behandler prompt-innhold som brukes i handels- eller investeringsbeslutninger som en regulert post. Cowork eksponerer ikke uforanderlige prompt-revisjons-logger. | WORM-storage revisjonslogger på gateway-laget, kryptografisk hashing på prompt-nivå, MAR Artikkel 14-overvåkingskroker. |
| Beskyttelse av egen IP | Prompter, skreddersydde verktøy og treningsdata bor i Anthropics infrastruktur under deres kommersielle vilkår. Greit for de fleste; fatalt for IP-sensitive forbrukermerker og biotech. | Alle prompter, verktøy og fine-tunes bor på infrastruktur du kontrollerer. Ingenting om driften din lekker til tredjepart. |
| Bredde i skreddersydde MCP-servere | Anthropic leverer rundt 20 first-party MCP-servere og kuraterer markedsplassen. Bedrifter trenger typisk 100–300 interne integrasjoner (Snowflake, Workday, intern data lake, gammel SAP). | Du bygger MCP-serverne du trenger på Model Context Protocol-spesifikasjonen. Ingen markedsplass-portvakt, ingen venting på et Anthropic-leverandørpartnerskap. |
| Agentorkestrering utover planlegging | Coworks planleggings-primitiver er flotte for "kjør dette hver mandag". De er ikke bygget for multi-agent-overvåkingsgrafer, deterministiske rekkverk eller human-in-the-loop-godkjenningsporter. | LangGraph eller CrewAI gir deg full grafovervåking, betinget ruting, retry-policyer og strukturerte overleveringer. |
Leser du denne tabellen og to eller flere rader beskriver bedriften din, er du allerede forbi "Cowork-duger"-linjen. Les videre.
Den selvhostede coworker-referansearkitekturen
En produksjons-selvhostet AI-coworker-stack har sju lag: inferens, gateway, minne, agentorkestrering, verktøy (MCP-servere), RBAC/revisjon og UI. Hvert lag har i 2026 to eller tre reelle alternativer, og stacken er såpass komponerbar at du kan bytte ett uten å skrive om de andre. Her er hva hvert lag gjør, hva vi bruker oftest og hva vi vokter.

Lag 1 — Inferens (modellen)
Det er her LLM-en faktisk kjører. Du har fire praktiske veier:
- Anthropic API direkte — raskest, lavest engineering-overhead, men du er tilbake i Anthropics datasti. Greit hvis bekymringen er skreddersydd orkestrering og ikke dataplassering.
- OpenRouter — én API over 100+ modeller. Flott for utvikling og modellsammenligning, mindre for bedriftsrevisjon.
- Bedrock eller Vertex AI — cloud-native private endepunkter med region-pinning. Anthropic Claude er tilgjengelig på begge. Det vanligste bedriftskompromisset: Claude-klassekvalitet med cloud-native compliance.
- On-prem-inferens — vLLM på H100/H200-maskinvare som kjører open-weight-modeller. Llama 3.3 70B, DeepSeek V3, Qwen 3 eller Mistral Large. Eneste vei for IL5/IL6 og dyrest i capex.
Anthropic leverer ikke Claude-modellvekter, så ekte on-prem med Claude er umulig. Må du være on-prem, velger du fra open-weight-modeller — og kvalitetsgapet til Claude Opus 4.7 har krympet betydelig de siste 18 månedene, men er ikke lukket.
Lag 2 — LLM-gateway
Gatewayen sitter mellom hver applikasjon og hver modell. Jobben dens: failover, kostnadsruting, revisjonslogging, rate limiting og (avgjørende) å abstrahere modellvalget slik at du kan bytte inferensveier uten å røre applikasjonskode.
Produksjonsalternativer:
- LiteLLM — open-source, selvhostbar, OpenAI-kompatibel API over 100+ leverandører. Gratis.
- Portkey — managed gateway med innebygde observability-dashbord. Bra for team som ikke vil drifte LiteLLM selv.
- Helicone — observability-first; passer godt med LiteLLM heller enn å erstatte det.
Dette laget er ikke forhandlingsbart i produksjon. Å hoppe over betyr å hardkode modellvalg i applikasjonen — og redeploye hver gang Anthropic slipper en ny modell eller sikkerhetsteamet krever en regional failover.
Lag 3 — Minne og gjenfinning
Tre delsystemer bor her:
- Vektordatabase — Pinecone (managed, raskeste vei) eller Qdrant (selvhostbar, riktig valg for on-prem-krav). Weaviate og pgvector er også gyldige; Qdrant har nå den reneste bedriftshistorien.
- Strukturert minne — Postgres for alt som drar nytte av SQL. Det meste "agent-minne" er faktisk relasjonelt, ikke semantisk.
- Korttidskontekst — Redis eller DynamoDB for sesjonstilstand, recent-conversation-cache og mellomresultater fra agenter.
Få dette laget riktig og agentene dine føles som om de husker ting. Få det galt og hver samtale starter fra null — greit for en chatbot og fatalt for en coworker.
Lag 4 — Agentorkestrering
Det er her Coworks planleggings-primitiver slutter å være nok. Alternativer:
- LangGraph — grafbasert multi-agent-overvåking. Best for arbeidsflyter med betinget ruting, retries og human-in-the-loop-godkjenninger.
- CrewAI — rollebaserte agent-crews. Renere abstraksjon for mønstre som "researchanalytiker + skribent + korrekturleser".
- Tilpasset DAG — for team med sterk bakgrunn i distribuerte systemer; full kontroll til prisen av å bygge alt selv.
For de fleste bedrifter leverer vi LangGraph fordi grafmodellen gjør revisjonshistorien enklere — hver overgang logges, hver beslutning er inspiserbar. (Og Anthropic Agent SDK 500 $-krediten vi dekker her subsidierer ofte de første tre månedene med Lag 4-utvikling.)
Lag 5 — Verktøy (MCP-servere)
Hver intern integrasjon blir en MCP-server. Salesforce, Snowflake, Jira, Confluence, Workday, data laket ditt, det interne HR-API-et. Model Context Protocol-spesifikasjonen er nå stabil og leveres i hvert større agent-rammeverk. Du skriver én server per datakilde; agent-laget oppdager dem under kjøring.
Dette er laget der Coworks plugin-markedsplass bryter sammen for bedrifter. Anthropic kuraterer markedsplassen — sakte og etter deres plan. Et selvhostet MCP-lag lar deg levere en server for en gammel SAP-modul på en uke, ikke et kvartal. Vi bygger typisk 15–40 MCP-servere per bedriftsoppdrag.
Lag 6 — RBAC + revisjonslogging
Det er her regulatorene avgjør om stacken din går i drift. Komponentene:
- Policymotor — Open Policy Agent (OPA) eller AWS Cedar. Hvert verktøykall og hvert modellkall passerer policy-evaluering. Per bruker, per rolle, per dataklasse.
- Revisjonspipeline — hver prompt, svar, verktøykall, valgt modell og kostnad logget med full oppbevaring. Vi bruker OpenTelemetry-traces som strømmer til en regulert cloud-SIEM eller et langtids S3-arkiv med WORM-compliance.
- PII/PHI-deteksjon — Presidio eller en tilpasset DLP-pipeline ved gatewayen. Redigér før logging; la aldri rå PHI nå revisjonslageret.
Dette laget er usynlig for sluttbrukere og er grunnen til at bedrifter faktisk betaler for bygget. Det er også laget Cowork ikke kan gi deg, strukturelt, fordi revisjonsgrensen ikke inkluderer infrastrukturen deres.
Lag 7 — UI
Coworks desktop-app-fordel på lag 7 forsvinner stort sett for bedrifter, fordi de fleste bedriftsbrukere allerede bor i Slack, Microsoft Teams eller en intern webportal. Praktiske UI-alternativer:
- Slack- eller Teams-bot — raskeste vei til adopsjon i eksisterende arbeidsflyter.
- Egen webapp — Next.js eller den eksisterende interne portalen din med en innebygd agent-overflate.
- Egen desktop-app — Electron er fortsatt det praktiske svaret hvis du vil ha Cowork-aktig "tredje fane"-opplevelse. De fleste bedrifter trenger det ikke.
Velg overflaten brukerne dine allerede bor i. Modell-lock-in-argumentet er her det motsatte av Coworks: i stedet for å tvinge brukerne inn i en ny app, møter stacken din dem der de er.
Det er en 7-lags stack, ikke et helgeprosjekt. De to neste seksjonene kvantifiserer hva det koster og hvor lang tid det tar.
5-års TCO — Cowork-lisenser vs selvhostet stack
Ved 200 plasser vinner Cowork Enterprise på kostnad. Ved 1 000+ plasser over fem år synker det selvhostede bygget til rundt 2 $/plass/dag alt inkludert — og krysser Coworks TCO et sted mellom 600 og 800 plasser. Den krysningen teller bare hvis ingen annen port (dataplassering, skreddersydd orkestrering, IP) allerede har tvunget bygget. For de fleste regulerte bedrifter er TCO-sammenligningen en fornuftssjekk, ikke en beslutningsdriver.
"5-års TCO: Cowork Enterprise vs Selvhostet (200 plasser)"
Datatabell
| "Sourcing-alternativ" | "5-års total" |
|---|---|
| "Cowork (200 plasser × 60 $/måned)" | 720 |
| "Selvhostet (200 plasser, bygg + 4 år ops)" | 1850 |
| "Selvhostet (1 000 plasser, amortisert)" | 2150 |
Forutsetningene bak tallene, fordi TCO-tekster som skjuler forutsetninger er ubrukelige:
- Cowork Enterprise — 60 $/plass/måned listepris for Enterprise-tier med EU-residens og BAA-tillegg, × 200 plasser × 60 måneder = 720 K $. Ingen markedsplass-tillegg inkludert.
- Selvhostet 200 plasser — byggekostnad År 1: 850 K $ (seks-ingeniørteam i to kvartaler, infra-capex, vektordatabase, observability-stack), pluss År 2–5 ops på 250 K $/år (to-ingeniørs ops-team, modellbruk, infra-opex). Total: 1,85 M $.
- Selvhostet 1 000 plasser — samme bygg År 1 (850 K $), År 2–5 ops skalerer til 325 K $/år (modellbruk vokser med brukere; engineering forblir omtrent flatt). Total: 2,15 M $, eller rundt 2,15 $/plass/dag snittet over fem år.
Den interessante linjen er den tredje. Engineering-kostnad på en selvhostet stack er stort sett fast — to ingeniører kan vedlikeholde en stack som betjener 100 eller 10 000 plasser. Modellbruk skalerer med brukere, men komprimeres ved batching og caching. TCO-krysningen med Cowork er reell, men skjer på en skala de fleste bedrifter bare når om de ruller ut plattformen over mange divisjoner.
Er du på 50 plasser og dataen ikke er regulert, vinner Cowork på alle akser. Er du på 5 000 plasser med en CISO, betaler det selvhostede bygget seg selv før År 3. Matematikken snur rundt 600–800 plasser — og de fleste bedriftspiloter ligger i eller over det området.
Time-to-value — Kurven som overrasker CFO-er
Cowork er brukbar i uke én og platår i måned to. Selvhostet raper sakte gjennom Q1, bryter forbi Cowork rundt måned seks og fortsetter. CFO-spørsmålet er ikke "hva er raskest" — det er "hvilken kurve matcher risikoprofilen og planhorisonten vår".
"Time-to-value: Cowork vs Selvhostet (12 måneder)"
Datatabell
| "Måneder" | "Cowork" | "Selvhostet" |
|---|---|---|
| "M1" | 70 | 5 |
| "M2" | 80 | 15 |
| "M3" | 80 | 35 |
| "M4" | 80 | 55 |
| "M5" | 80 | 70 |
| "M6" | 80 | 80 |
| "M9" | 80 | 92 |
| "M12" | 80 | 100 |
Tre ting denne grafen undervurderer:
-
Coworks måned-1-score er høy fordi det er et produkt, ikke et prosjekt. Anthropic har levert UX-en og integrasjonene; du adopterer. 30-poengs-gapet i måned 1 er reelt, og det teller når du må vise AI-ROI til et styre som har hørt om AI i to år.
-
Den selvhostede kurven er ikke lineær fordi arbeidet ikke er det. Måned 1–2 er arkitektur, leverandørvalg og Lag 1–2-rørlegging. Måned 3–4 er de første faktiske agentene i drift på stacken. Måned 5–6 er når marginalkostnaden for agent nummer fem faller til en brøkdel av agent nummer ett. Det er bøyningspunktet — og grunnen til at plattformbygging føles frustrerende sakte de første 90 dagene.
-
Coworks platå er reelt, ikke baktalelse. Cowork er utmerket i det Anthropic leverer for det. Det er ikke designet for å strekke seg forbi den konvolutten, og markedsplassen finnes nettopp slik at de ikke trenger å fortsette å utvide den selv.
Vi gikk gjennom samme kurveform i vår build-vs-buy-analyse for AI-stemmeagenter — prinsippene oversettes. Lever eller dør business case-et i måned 3, kjøp. Lever det i måned 12, bygg.
Build-your-own-beslutningsmatrisen
Skår disse sju spørsmålene 0, 5 eller 10. Over 25 bygger du selv. Mellom 15 og 25 piloterer du Cowork og revurderer. Under 15 blir du på Cowork. Matrisen er artikkelens høyeste-signal-stykke; bokmerker du noe, bokmerk tabellen.
| # | Spørsmål | 0 (Nei) | 5 (Av og til) | 10 (Ja) |
|---|---|---|---|---|
| 1 | Berører noen av AI-arbeidsbelastningene våre data som ikke kan forlate VPC-en vår? | 0 | 5 | 10 |
| 2 | Er vi i en regulert bransje (helse, finans, forsvar, myndighet)? | 0 | 5 | 10 |
| 3 | Har vi egen IP/prompter/verktøy vi ikke vil dele med en leverandør? | 0 | 5 | 10 |
| 4 | Vil vi ha >25 daglige AI-brukere innen 12 måneder? | 0 | 5 | 10 |
| 5 | Trenger vi MCP-servere Anthropic ikke leverer? | 0 | 5 | 10 |
| 6 | Forventer vi >200 K $/år i Cowork-plassutgifter? | 0 | 5 | 10 |
| 7 | Trenger vi agentorkestrering utover Coworks planleggings-primitiver? | 0 | 5 | 10 |
Vi har anvendt denne matrisen på 30+ AI-integrasjonsprosjekter de siste 18 månedene. Andelen organisasjoner over 25 har gått fra omtrent 30 % på slutten av 2024 til omtrent 55 % i mai 2026 — drevet hovedsakelig av GDPR-håndheving og SEC AI Disclosure Rule fra 2025. Skiftet er ikke ideologisk; det er regulatorisk.
Et merkverdig mønster: skår klumper seg ved ytterpunktene. Bedrifter scorer enten 5–15 (Cowork er åpenbart riktig) eller 35–70 (selvhostet er åpenbart riktig). Midtbåndet 15–25 er sjeldnere enn det ser ut og representerer som regel bedrifter på vei til å krysse en regulatorisk linje de ennå ikke merker.
Når Cowork fortsatt vinner, selv i bedriftsskala
Selv i bedrifter som scorer 50+ på matrisen vinner Cowork fortsatt for tre mønstre: det ikke-regulerte markedsteamet, 90-dagers prototype-then-buy og bolt-on for modne interne AI-plattformer. Å selvhoste alt er like feil som å kjøpe alt; kunsten er å rute hver arbeidsflyt til riktig stack.
De tre mønstrene:
-
Det ikke-regulerte markedsteamet i en regulert bedrift. Et pharma-firma kan ikke legge PHI på Cowork, men brand-markedsteamet rører ikke PHI — det skriver kampanjebriefer og analyserer kanalprestasjon. Cowork passer der. Å rute lavsensitivt arbeid til Cowork og høysensitivt til intern stack er den åpenbare, men sjelden implementerte arkitekturen, og vi behandler spørsmålet om å erstatte markedsledere i detalj annet sted.
-
Prototype-then-buy-mønstre. Bruk Cowork i 60–90 dager for å bevise at arbeidsflyten virker på ekte data og ekte brukere. Dukker ROI opp, bygg da. Gjør den ikke det, har du brukt 20 K $ på Cowork-plasser i stedet for 200 K $ på et bygg som løser et problem du ikke hadde. 90-dagers Cowork-piloten er den høyeste kvaliteten av kravinnsamling i bedrifts-AI.
-
Modne bedrifter med interne AI-plattformer allerede bygget. Har du allerede bygd 7-lags stacken for høysensitivt arbeid, blir det raskt og billig å bolte Cowork på lavsensitiv overflate, og det reduserer "skygge-IT"-risikoen at team adopterer AI-verktøy på egen hånd.
Coworks SMB-sweet-spot gjelder også inne i bedrifter — for hvert underteam som opererer som en småbedrift er Cowork strukturelt riktig verktøy, uavhengig av morselskapets regulatoriske profil.
Selvhostet er riktig svar for sensitive arbeidsbelastninger. Cowork er riktig svar for alt annet. Kunsten er å vite hvilket som er hvilket — og ikke late som det er binært.
Hvordan Techsy bygger bedrifts-AI-integrasjoner
Vi har levert 30+ AI-integrasjonsprosjekter siden 2024 i regulert finans, helse-nært, forsvar-nært og IP-sensitive forbrukermerker. Metodologien har knapt endret seg fordi arkitekturen knapt har endret seg — det er de samme sju lagene, tilpasset per regulatorisk profil.
Firfase-metodologien:
-
Fase 1 — Arkitektur- og TCO-workshop (2 uker, fastpris). Vi scorer beslutningsmatrisen med teamet ditt, skisserer 7-lags arkitekturen for begrensningene dine og bygger den ærlige TCO-modellen. Du går derfra med en brukbar artefakt uavhengig av om du leier oss for Fase 2.
-
Fase 2 — Referansebygg (8–12 uker). Én agent i produksjon på hele 7-lags stacken — typisk arbeidsflyten med høyest verdi og lavest politisk risiko vi identifiserte i Fase 1. Produksjonsklar, ikke en demo. Vi bruker Anthropic Agent SDK og 500 $-krediten vi dekker her til å subsidiere tidlig Lag 4-arbeid der det passer.
-
Fase 3 — Plattformutvidelse (3–6 måneder). Agenter 2 til N på samme stack. Her kollapser marginalkostnaden per ny agent — vanligvis 30–60 % av kostnaden for Fase 2-referansebygget. 7-lags stacken blir en plattform.
-
Fase 4 — Overlevering og drift (løpende). Teamet ditt eier stacken. Vi blir på retainer for modelloppgraderinger, nye MCP-servere og kvartalsvise arkitekturgjennomganger.
Stacken vi leverer som standard i 2026: Anthropic Claude Opus 4.7 + LangGraph + Pinecone (eller Qdrant for full on-prem) + LiteLLM-gateway + vLLM for on-prem-inferensveier, bak OPA-policy-RBAC og OpenTelemetry-observability. Hver komponent er utskiftbar; ingenting er skreddersydd bare for å være det. Den agentic AI-deploymentplattformen vi bruker pakker denne stacken inn i en deploybar overflate, og agent-utviklingspraksisen vår dekker engineering-modellen i dybden.
Vil du score matrisen sammen og se hvordan 7-lags arkitekturen din ville se ut, book en gratis 30-minutters arkitektursamtale med teamet vårt. Ingen forutsetninger, ingen lysark — vi går gjennom begrensningene dine og skisserer stacken live.
Vi ser på produktet vi respektfullt kritiserer
Anthropic har levert et virkelig godt produkt. De neste tretten minuttene er verdt tiden din — det er den klareste artikuleringen av hva Cowork er til for, fra teamet som bygde det.
Se den før du forplikter deg til en vei. Tenker du etterpå at Cowork løser problemet ditt — kjøp Cowork. Tar du deg selv i å tenke "dette er flott, men…", er artikkelens andre halvdel for deg. Vi er ikke anti-Cowork. Vi er anti-kjøpe-feil-verktøy-for-din-regulatoriske-profil.
Migreringsvei — Fra Cowork-pilot til selvhostet produksjon
Det vanligste mønsteret vi ser i 2026 er ikke Cowork-eller-selvhostet. Det er Cowork-så-selvhostet, med en ren migreringsplan. Her er firstegsveien vi anbefaler:
- Måned 0–3 — Cowork-pilot. Bevis arbeidsflyten på ekte brukere med ekte data (bare lavsensitive arbeidsflyter). Dokumenter hva som virker, hva som feiler og hva du skulle ønske var annerledes.
- Måned 3–4 — Arkitekturbeslutning. Skår matrisen med dataene fra Fase 1. Er du over 25, forplikt deg til bygget. Skru ikke av Cowork ennå.
- Måned 4–10 — Parallellbygg. Bygg 7-lags stacken parallelt med fortsatt Cowork-bruk. Ikke-sensitive arbeidsflyter blir værende på Cowork; bygget retter seg mot de regulerte.
- Måned 10–12 — Overgang per arbeidsflyt, ikke per avdeling. Sensitive arbeidsflyter migrerer først til selvhostet; ikke-sensitive kan bli værende ubegrenset på Cowork om rutingen er fornuftig.

Overgangsregelen er den de fleste team gjør feil. Migrering per avdeling skaper et politisk tvangsmarsj-problem; migrering per arbeidsflyt-type lar hvert team adoptere riktig verktøy for jobben foran seg. Beslutningsmatrisen scorer per arbeidsflyt, ikke per avdeling, av samme grunn.
Vi har også sett det motsatte mønsteret — selvhostet-så-Cowork — i bedrifter som bygde tidlig og nå vil gi ikke-regulerte team en rask overflate. Sammenligningen med ChatGPT Agents er riktig referanse hvis du sitter fast mellom Cowork og et konkurrerende buy-side-produkt etter at du har forpliktet deg til en hybridarkitektur.
Vanlige spørsmål
Er det ikke mye dyrere å bygge selv?
Ikke alltid og sjelden enkelt. Ved 200 plasser vinner Cowork på kostnad over fem år. Mellom 600 og 800 plasser krysser kurvene seg; ved 1 000+ plasser er selvhostet billigere. Viktigere: scorer du 25+ på beslutningsmatrisen er kostnadssammenligningen akademisk — regulatoriske eller suverenitetskrav har allerede bestemt.
Hvor lang tid tar det å levere en selvhostet bedrifts-agentstack?
8–12 uker for første agent i produksjon på hele 7-lags stacken, 3–6 måneder for plattformen (agenter 2 til N) og løpende for modelloppgraderings-tredemøllen. Cowork leverer på 1–2 uker. De fleste bedrifter bytter 8-ukersdeltaet mot suverenitet og tilpasning; de som ikke gjør det, var ikke bedrifter som måtte bygge.
Kan vi starte med Cowork og migrere senere?
Ja — det er det vanligste mønsteret vi ser i 2026. Bruk Cowork måned 0–3 for å bevise arbeidsflyten, bygg 7-lags stacken parallelt måned 4–10, og bytt deretter per arbeidsflyt-type heller enn per avdeling. Migreringen er vanskeligere enn å starte selvhostet fra dag én, men mye raskere enn å bygge i blinde.
Hva med Claude Enterprises Trust Center?
Anthropics Trust Center dekker SOC 2 Type II, ISO 27001, EU-dataresidens på Enterprise og BAA for helse. En sterk historie for det den dekker. Den dekker ikke ITAR, IL5/IL6 sovereign-cloud, hermetisk M&A-deal-room-isolering eller arbeidsflyter der selve prompt-innholdet er klassifisert eller regulert. Trust Center er nødvendig for noen scenarier og strukturelt utilstrekkelig for andre.
Er on-prem-deployment av Anthropic-modeller tillatt?
Nei. Anthropic leverer ikke Claude-modellvekter, så ekte on-prem-inferens av Claude er umulig i 2026. On-prem-selvhosting krever open-weight-alternativer — Llama 3.3, DeepSeek V3, Qwen 3 eller Mistral Large på vLLM. Bedrock og Vertex tilbyr private-endpoint-alternativer som noen regulatorer aksepterer som praktisk ekvivalent til on-prem; sjekk med compliance-teamet før du antar.
Hva er den løpende vedlikeholdskostnaden over tid?
Omtrent 250 K $/år for et 2-ingeniørs ops-team pluss modellbruk og infrastruktur i 200-plass-skala. Tallet stiger til omtrent 325 K $/år ved 1 000 plasser — mesteparten er fast engineering, ikke variabel infrastruktur. Modellbruk skalerer med brukere, men komprimeres med batching, caching og ruting av små forespørsler til billigere modeller via gateway-laget.
Hvem eier promptene og verktøyene vi utvikler?
Du, fullt ut, på en selvhostet stack. På Cowork lagres promptene i Anthropics infrastruktur under deres kommersielle vilkår — greit for de fleste bedrifter, dealbreaker for IP-sensitive bransjer (forbrukermerker, biotech, regulert finans). Eierskapshistorien er en av de undervurderte grunnene til at modne bedrifter selvhoster.
Støtter dere hybrid — noen arbeidsflyter på Cowork, andre selvhostet?
Ja, og vi anbefaler det oftere enn ren selvhosting. Rut lavsensitive arbeidsflyter til Cowork og høysensitive til intern stack. En LiteLLM-gateway kan fan-out per arbeidsflyt-type med enkle ruting-regler, og revisjons- og policy-lagene kan behandle begge overflater ensartet.
Hvordan håndterer dere modelloppgraderings-tredemøllen på en selvhostet stack?
LiteLLM-gatewayen abstraherer modellvalg. Når Anthropic slipper en ny modell peker du én config mot den. Når en open-weight-modell går forbi closed-source-incumbenten på en spesifikk oppgave omdirigerer du den beregningstunge belastningen til vLLM uten å røre applikasjonskode. 7-lags arkitekturen er eksplisitt designet for å beskytte deg mot modell-lock-in — noe Cowork by design ikke kan.
Avslutning
Cowork er et glimrende produkt for arbeidet det er bygd for, og det er ikke riktig svar for regulerte bedrifter med suverenitets-, IP- eller skreddersydde orkestreringskrav. Den 7-lags selvhostede referansearkitekturen i denne artikkelen er den samme vi har levert 30+ ganger siden 2024; beslutningsmatrisen er artefakten vi går gjennom med hver kunde i Fase 1. Les den fullstendige Cowork-guiden hvis du ikke har, og kom tilbake hit når du er klar til å snakke arkitektur.
Vil du ha en brukbar versjon av beslutningsmatrisen og et utkast til 7-lags arkitektur for begrensningene dine — ta kontakt, vi skisserer live og du går derfra med artefakten, uansett om vi jobber sammen etterpå eller ikke.