
Claude Cowork Alternative: Warum regulierte Unternehmen ihren eigenen KI-Coworker-Stack bauen (2026)
Wenn Sie unseren vollständigen Cowork-Leitfaden gelesen haben und Ihr Bauchgefühl Ihnen sagt, dass das Produkt Ihre sensibelsten Workflows nicht abdeckt, liegen Sie wahrscheinlich richtig. Claude Cowork passt hervorragend zu der Arbeit, für die es entwickelt wurde — und schlecht zu der regulierten, maßgeschneiderten, souveränitätsgebundenen Arbeit, die den Kalender eines Unternehmens füllt. Hier ist die ehrliche Analyse, die Referenzarchitektur und die TCO-Berechnung.
Wo Claude Cowork wirklich glänzt
Cowork ist die richtige Antwort, wenn Ihre Arbeit auf nicht-sensiblen Daten basiert, Ihr Team zwischen 5 und 500 Personen umfasst und Sie lieber in zwei Wochen als in zwei Quartalen produktiv sein möchten. Anthropic hat die UX für KI-Coworker für genau diese Zielgruppe perfektioniert, und die vier in den letzten sechs Wochen ausgelieferten Branchen-Bundles beweisen, dass sie in das Produkt als langfristiges Angebot investieren — nicht als Nebenprojekt.
Drei Cowork-Sweet-Spots sind in unserem Cluster gut dokumentiert:
- Marketing-Operations — Content-Briefings, Zielgruppenforschung, Multi-Channel-Orchestrierung. Coworks Plugin-Marktplatz und Scheduling-Primitive passen sauber zu der Art, wie Marketing-Teams tatsächlich arbeiten. Siehe unsere Marketing-Ops-Analyse für die Workflow-Muster.
- Rechtsabteilungen — Vertragsprüfung, Redline-Reviews, jurisdiktionsspezifische Recherche. Das Legal-Bundle, das Anthropic am 12. Mai ausgeliefert hat, war das erste vertikale Bundle und ist immer noch das ausgereifteste. Wir haben die Anwendungsfälle in unserer Analyse für Rechtsteams durchleuchtet.
- Kleine und mittelständische Unternehmen — Rechnungsstellung, Kundennachverfolgung, leichtgewichtiges Reporting. Das SMB-Bundle (13. Mai) ist wirklich gut für Unternehmen mit weniger als 250 Mitarbeitern, die keinen CISO im Nacken haben. Unser SMB-Review geht ins Detail.
Anthropic hat zudem bestätigt, dass Financial Services das nächste vertikale Bundle ist, und der auf der Code w/ Claude am 11. Mai angekündigte Managed-Agents-Stack hebt die Decke dessen an, was Coworks Plugin-Marktplatz leisten kann. All das steht außer Frage.
Cowork ist die richtige Antwort für die meisten Unternehmen in den meisten Fällen. Dieser Beitrag handelt vom Rest — der regulierten, souveränitätsgebundenen, IP-schweren Minderheit, in der Cowork das falsche Werkzeug ist, auch wenn es ein großartiges Produkt ist.
Die 8 Enterprise-Szenarien, in denen Cowork an seine Grenzen stößt
Acht Workflows trennen "Cowork ist okay" von "Cowork ist unmöglich": GDPR-Datenresidenz, Gesundheitsdaten (PHI), Verteidigung und Behörden mit klassifizierten Daten, M&A-Deal-Room-Vertraulichkeit, regulierte Finanzdienstleistungen unter SEC/FINRA, Schutz geistigen Eigentums, individuelle MCP-Server-Breite über Anthropics rund 20 Standard-Server hinaus und Agenten-Orchestrierungsmuster, für die Anthropic nicht entwickelt hat. Jeder dieser Punkte ist ein Ja-oder-Nein-Gate, keine Präferenz.
| Szenario | Wo Cowork nicht reicht | Was selbstgehostet bietet |
|---|---|---|
| GDPR-Datenresidenz | Cowork Enterprise bietet EU-Datenresidenz, aber keine vollständige Single-Region-Bindung für alle Subprozessoren und Modellpfade. Grenzüberschreitende Telemetrie ist schwer prüfbar. | Region-fixierte Inferenz (Bedrock EU, Vertex EU, On-Premise) plus vollständige DLP auf jeder Schicht; die Subprozessor-Liste ist Ihre eigene. |
| Gesundheitsdaten (PHI) | Anthropics BAA deckt den Modell-Endpunkt ab, nicht die nachgelagerten Tool-Aufrufe der Kunden oder Drittanbieter-Plugins aus dem Marktplatz. Plugin-Wildwuchs sprengt den HIPAA-Geltungsbereich. | Vollständige PHI-Trennung über mandantenisolierte Infrastruktur, jeder MCP-Server gegen Ihren BAA geprüft, Prompts und Antworten mit von Ihnen festgelegten Aufbewahrungsregeln protokolliert. |
| Verteidigung / Behörden klassifiziert | ITAR, IL5/IL6 und Äquivalente erfordern Sovereign-Cloud- oder On-Prem-Deployment. Cowork ist SaaS. | vLLM oder selbstgehostetes Llama 3.3 auf GovCloud, IL5-zertifizierter oder On-Premise-Hardware. Anthropics Closed-Weight-Modelle laufen hier nicht. |
| M&A-Deal-Room-Vertraulichkeit | Prompts, die Deal-Konditionen beschreiben, dürfen die Deal-Room-VPC nie verlassen. Coworks Marktplatz-Plugins und globale Speicherfunktionen sind strukturell inkompatibel. | Hermetischer Per-Deal-Stack auf flüchtiger Infrastruktur, die nach Deal-Abschluss gelöscht wird. Null geteilter Speicher zwischen Deals. |
| Regulierte Finanzdienstleistungen (SEC, FINRA) | Die SEC-Regel zur KI-Offenlegung von 2025 behandelt Prompt-Inhalte, die für Handels- oder Investmententscheidungen verwendet werden, als regulierten Datensatz. Cowork bietet keine unveränderlichen Prompt-Audit-Logs. | WORM-Storage-Audit-Logs auf der Gateway-Schicht, kryptografisches Hashing auf Prompt-Ebene, MAR-Artikel-14-Überwachungs-Hooks. |
| Schutz geistigen Eigentums | Prompts, individuelle Tools und Trainingsdaten liegen in Anthropics Infrastruktur unter deren kommerziellen Bedingungen. Für die meisten okay; fatal für IP-sensible Konsumgütermarken und Biotech. | Alle Prompts, Tools und Fine-Tunes liegen auf Infrastruktur, die Sie kontrollieren. Nichts an Ihrer Betriebsweise gelangt nach außen. |
| Individuelle MCP-Server-Breite | Anthropic liefert rund 20 Erstanbieter-MCP-Server und kuratiert den Marktplatz. Unternehmen benötigen typischerweise 100–300 interne Integrationen (Snowflake, Workday, internes Data Lake, Legacy-SAP). | Sie bauen die MCP-Server, die Sie brauchen, auf der Model-Context-Protocol-Spezifikation. Kein Marktplatz-Gatekeeper, kein Warten auf eine Anthropic-Vendor-Partnerschaft. |
| Agenten-Orchestrierung über Scheduling hinaus | Coworks Scheduling-Primitive sind super für "läuft jeden Montag". Sie sind nicht für Multi-Agent-Supervision-Graphen, deterministische Guardrails oder Human-in-the-Loop-Freigaben gebaut. | LangGraph oder CrewAI bieten vollständige Graph-Supervision, bedingtes Routing, Retry-Policies und strukturierte Übergaben. |
Wenn Sie diese Tabelle lesen und zwei oder mehr Zeilen Ihr Unternehmen beschreiben, sind Sie bereits jenseits der Cowork-ist-okay-Linie. Lesen Sie weiter.
Die selbstgehostete Coworker-Referenzarchitektur
Ein produktiver selbstgehosteter KI-Coworker-Stack hat sieben Schichten: Inferenz, Gateway, Speicher, Agenten-Orchestrierung, Tools (MCP-Server), RBAC/Audit und UI. Jede Schicht hat 2026 zwei oder drei realistische Optionen, und der Stack ist so komponierbar, dass Sie eine davon austauschen können, ohne die anderen umzuschreiben. Hier ist, was jede Schicht tut, was wir am häufigsten einsetzen und worauf zu achten ist.

Schicht 1 — Inferenz (das Modell)
Hier läuft das LLM tatsächlich. Sie haben vier praktische Pfade:
- Anthropic API direkt — schnellster, geringster Engineering-Aufwand, aber Sie sind wieder in Anthropics Datenpfad. Okay, wenn Ihre Sorge maßgeschneiderte Orchestrierung ist, nicht aber Datenresidenz.
- OpenRouter — eine einzige API über 100+ Modelle. Großartig für Entwicklung und Modellvergleichstests, weniger gut für Enterprise-Audit.
- Bedrock oder Vertex AI — Cloud-native private Endpunkte mit Region-Bindung. Anthropic Claude ist auf beiden verfügbar. Das ist der häufigste Enterprise-Kompromiss: Sie bekommen Claude-Class-Qualität mit Cloud-nativer Compliance.
- On-Premise-Inferenz — vLLM auf H100/H200-Hardware mit Open-Weight-Modellen. Llama 3.3 70B, DeepSeek V3, Qwen 3 oder Mistral Large. Der einzige Pfad für IL5/IL6 und der teuerste in der Capex.
Anthropic liefert keine Claude-Modellgewichte aus, also ist echtes On-Premise mit Claude unmöglich. Wenn Sie unbedingt On-Premise müssen, wählen Sie aus Open-Weight-Modellen — und die Qualitätslücke zu Claude Opus 4.7 hat sich in den letzten 18 Monaten deutlich verringert, ist aber nicht geschlossen.
Schicht 2 — LLM-Gateway
Das Gateway sitzt zwischen jeder Anwendung und jedem Modell. Seine Aufgabe ist Failover, Cost-Routing, Audit-Logging, Rate Limiting und (kritisch) die Abstraktion der Modellwahl, damit Sie Inferenz-Pfade tauschen können, ohne Anwendungscode anzufassen.
Produktive Optionen:
- LiteLLM — Open Source, selbst hostbar, OpenAI-kompatible API über 100+ Anbieter. Kostenlos.
- Portkey — verwaltetes Gateway mit eingebauten Observability-Dashboards. Gut für Teams, die LiteLLM nicht selbst betreiben wollen.
- Helicone — Observability-first; passt gut zu LiteLLM, statt es zu ersetzen.
Diese Schicht ist im Produktivbetrieb nicht verhandelbar. Sie zu überspringen bedeutet, die Modellwahl in Ihre Anwendung zu hardcoden — und dann jedes Mal neu zu deployen, wenn Anthropic ein neues Modell ausliefert oder Ihr Security-Team einen regionalen Failover fordert.
Schicht 3 — Speicher und Retrieval
Drei Subsysteme leben hier:
- Vektordatenbank — Pinecone (verwaltet, schnellster Pfad) oder Qdrant (selbst hostbar, der richtige Anruf für On-Prem-Anforderungen). Weaviate und pgvector sind ebenfalls valide; Qdrant hat aktuell die sauberste Enterprise-Story.
- Strukturierter Speicher — Postgres für alles, was von SQL profitiert. Der meiste "Agenten-Speicher" ist tatsächlich relational, nicht semantisch.
- Kurzzeit-Kontext — Redis oder DynamoDB für Session-State, Recent-Conversation-Cache und Zwischenergebnisse von Agenten.
Machen Sie diese Schicht richtig, fühlen sich Ihre Agenten an, als würden sie sich erinnern. Machen Sie sie falsch, fängt jede Konversation bei null an — was für einen Chatbot okay und für einen Coworker tödlich ist.
Schicht 4 — Agenten-Orchestrierung
Hier hören Coworks Scheduling-Primitive auf zu reichen. Optionen:
- LangGraph — graph-basierte Multi-Agent-Supervision. Am besten für Workflows mit bedingtem Routing, Retries und Human-in-the-Loop-Freigaben.
- CrewAI — rollenbasierte Agenten-Crews. Sauberere Abstraktion für Muster wie "Research-Analyst + Writer + Reviewer".
- Custom DAG — für Teams mit starkem Distributed-Systems-Hintergrund; gibt Ihnen vollständige Kontrolle zum Preis, alles selbst zu bauen.
Für die meisten Unternehmen liefern wir LangGraph aus, weil das Graph-Modell die Audit-Story einfacher macht — jeder Übergang wird protokolliert, jede Entscheidung ist prüfbar. (Und das Anthropic Agent SDK $500-Guthaben, das wir hier behandeln, subventioniert oft die ersten drei Monate Layer-4-Entwicklung.)
Schicht 5 — Tools (MCP-Server)
Jede interne Integration wird zum MCP-Server. Salesforce, Snowflake, Jira, Confluence, Workday, Ihr Data Lake, Ihre interne HR-API. Die Model-Context-Protocol-Spezifikation ist mittlerweile stabil und in jedem großen Agenten-Framework verfügbar. Sie schreiben einen Server pro Datenquelle; die Agenten-Schicht entdeckt sie zur Laufzeit.
Das ist die Schicht, in der Coworks Plugin-Marktplatz für Unternehmen zusammenbricht. Anthropic kuratiert den Marktplatz — langsam und nach ihrem Zeitplan. Eine selbstgehostete MCP-Schicht lässt Sie einen Server für ein Legacy-SAP-Modul in einer Woche statt einem Quartal ausliefern. Wir bauen typischerweise 15–40 MCP-Server pro Enterprise-Engagement.
Schicht 6 — RBAC + Audit-Logging
Hier entscheiden die Regulierer, ob Ihr Stack live geht. Die Komponenten:
- Policy-Engine — Open Policy Agent (OPA) oder AWS Cedar. Jeder Tool-Aufruf und jeder Modell-Aufruf läuft durch Policy-Evaluierung. Pro-Benutzer, pro-Rolle, pro-Datenklasse.
- Audit-Pipeline — jeder Prompt, jede Antwort, jeder Tool-Aufruf, jedes ausgewählte Modell, jeder entstandene Kostenpunkt mit vollständiger Aufbewahrung protokolliert. Wir verwenden OpenTelemetry-Traces, die in ein reguliertes Cloud-SIEM oder ein langfristiges S3-Archiv mit WORM-Compliance fließen.
- PII/PHI-Erkennung — Presidio oder eine eigene DLP-Pipeline am Gateway. Redigieren vor dem Logging; lassen Sie nie rohes PHI in Ihren Audit-Speicher.
Diese Schicht ist für Endbenutzer unsichtbar und der Grund, warum Unternehmen den Build tatsächlich kaufen. Sie ist auch die Schicht, die Cowork strukturell nicht liefern kann, weil die Audit-Grenze ihre Infrastruktur einschließt.
Schicht 7 — UI
Coworks Desktop-App-Vorteil auf Schicht 7 verschwindet für Unternehmen größtenteils, weil die meisten Enterprise-Anwender ohnehin in Slack, Microsoft Teams oder einem eigenen Web-Portal leben. Praktische UI-Optionen:
- Slack- oder Teams-Bot — schnellster Pfad zur Adoption innerhalb bestehender Workflows.
- Eigene Web-App — Next.js oder Ihr bestehendes internes Portal mit eingebetteter Agenten-Oberfläche.
- Eigene Desktop-App — Electron ist immer noch die praktische Antwort, wenn Sie die Cowork-artige "dritte Registerkarte" wollen. Die meisten Unternehmen brauchen das nicht.
Wählen Sie die Oberfläche, in der Ihre Anwender bereits leben. Das Modell-Lock-in-Argument hier ist die Umkehrung von Coworks: Statt Anwender in eine neue App zu zwingen, trifft Ihr Stack sie dort, wo sie sind.
Das ist ein 7-Schichten-Stack, kein Wochenend-Projekt. Die nächsten zwei Abschnitte quantifizieren, was es kostet und wie lange es dauert.
5-Jahres-TCO — Cowork-Lizenzen vs. Selbstgehosteter Stack
Bei 200 Plätzen gewinnt Cowork Enterprise bei den Kosten. Bei 1.000+ Plätzen über fünf Jahre fällt der selbstgehostete Build auf rund 2 $/Platz/Tag — und überschreitet Coworks TCO irgendwo zwischen 600 und 800 Plätzen. Diese Überschneidung zählt allerdings nur, wenn nicht schon ein anderes Gate (Datenresidenz, individuelle Orchestrierung, IP) den Build erzwungen hat. Für die meisten regulierten Unternehmen ist der TCO-Vergleich eine Sanity-Check, kein Entscheidungstreiber.
"5-Jahres-TCO: Cowork Enterprise vs. Selbstgehostet (200 Plätze)"
Datentabelle
| "Sourcing-Option" | "5-Jahres-Total" |
|---|---|
| "Cowork (200 Plätze × 60 $/Monat)" | 720 |
| "Selbstgehostet (200 Plätze, Build + 4 Jahre Ops)" | 1850 |
| "Selbstgehostet (1.000 Plätze, amortisiert)" | 2150 |
Die Annahmen hinter diesen Zahlen, weil TCO-Beiträge, die Annahmen verbergen, nutzlos sind:
- Cowork Enterprise — 60 $/Platz/Monat Listenpreis für die Enterprise-Stufe mit EU-Residency und BAA-Add-on, × 200 Plätze × 60 Monate = 720 K $. Keine Marktplatz-Add-ons eingerechnet.
- Selbstgehostet 200 Plätze — Jahr-1-Build-Kosten 850 K $ (Sechser-Engineering-Team für zwei Quartale, Infrastruktur-Capex, Vektordatenbank, Observability-Stack) plus Jahre 2–5 Ops zu 250 K $/Jahr (Zweier-Ops-Team, Modellnutzung, Infrastruktur-Opex). Total: 1,85 M $.
- Selbstgehostet 1.000 Plätze — gleiche Jahr-1-Build-Kosten (850 K $), Jahre 2–5 Ops skalieren auf 325 K $/Jahr (Modellnutzung wächst mit Benutzern; Engineering bleibt etwa konstant). Total: 2,15 M $, oder rund 2,15 $/Platz/Tag im Fünfjahresmittel.
Die interessante Linie ist die dritte. Engineering-Kosten auf einem selbstgehosteten Stack sind weitgehend fix — zwei Ingenieure können einen Stack pflegen, der 100 oder 10.000 Plätze bedient. Modellnutzung skaliert mit Benutzern, komprimiert sich aber durch Batching und Caching. Die TCO-Überschneidung mit Cowork ist real, passiert aber in einer Größenordnung, die die meisten Unternehmen nur erreichen, wenn sie die Plattform über viele Abteilungen ausrollen.
Wenn Sie bei 50 Plätzen sind und Ihre Daten nicht reguliert sind, gewinnt Cowork auf jeder Achse. Wenn Sie bei 5.000 Plätzen mit einem CISO sind, amortisiert sich der selbstgehostete Build vor Jahr 3. Die Mathematik dreht sich um 600–800 Plätze um — und die meisten Enterprise-Piloten liegen in oder über diesem Bereich.
Time-to-Value — Die Kurve, die CFOs überrascht
Cowork ist in Woche eins nutzbar und plateauiert in Monat zwei. Selbstgehostet rampt langsam durch das erste Quartal, überholt Cowork um Monat sechs und macht weiter. Die CFO-Frage ist nicht "was ist schneller" — es ist "welche Kurve passt zu unserem Risikoprofil und unserem Planungshorizont".
"Time-to-Value: Cowork vs. Selbstgehostet (12 Monate)"
Datentabelle
| "Monate" | "Cowork" | "Selbstgehostet" |
|---|---|---|
| "M1" | 70 | 5 |
| "M2" | 80 | 15 |
| "M3" | 80 | 35 |
| "M4" | 80 | 55 |
| "M5" | 80 | 70 |
| "M6" | 80 | 80 |
| "M9" | 80 | 92 |
| "M12" | 80 | 100 |
Drei Dinge, die dieses Diagramm untertreibt:
-
Coworks Monat-1-Score ist hoch, weil es ein Produkt ist, kein Projekt. Anthropic hat die UX und die Integrationen ausgeliefert; Sie adoptieren sie. Die 30-Punkte-Lücke in Monat 1 ist real, und sie zählt, wenn Sie einem Vorstand, der seit zwei Jahren von KI hört, KI-ROI demonstrieren müssen.
-
Die Selbstgehostet-Kurve ist nicht linear, weil die Arbeit nicht linear ist. Monate 1–2 sind Architektur, Vendor-Auswahl und Layer-1–2-Plumbing. Monate 3–4 sind die ersten echten Agenten auf dem Stack. Monate 5–6 sind, wenn die Grenzkosten für Agent Nummer 5 auf einen Bruchteil der Kosten von Agent Nummer 1 sinken. Das ist die Inflexion — und der Grund, warum Plattformbau die ersten 90 Tage frustrierend langsam wirkt.
-
Das Cowork-Plateau ist real, keine Diffamierung. Cowork ist hervorragend in dem, was Anthropic dafür ausliefert. Es ist nicht dafür entwickelt, über diese Hülle hinaus zu skalieren, und der Marktplatz existiert genau deshalb, damit sie sich nicht selbst weiter erweitern müssen.
Wir sind die gleiche Kurvenform in unserer Build-vs-Buy-Analyse für KI-Sprachagenten durchgegangen — die Prinzipien übertragen sich. Wenn Ihr Business-Case in Monat 3 lebt oder stirbt, kaufen. Wenn er in Monat 12 lebt, bauen.
Die Build-Your-Own-Entscheidungsmatrix
Bewerten Sie diese sieben Fragen mit 0, 5 oder 10. Wenn Sie über 25 punkten, bauen Sie selbst. Zwischen 15 und 25 piloten Sie Cowork und überprüfen erneut. Unter 15 bleiben Sie bei Cowork. Die Matrix ist das aussagekräftigste Element dieses Beitrags; wenn Sie etwas bookmarken, bookmarken Sie die Tabelle.
| # | Frage | 0 (Nein) | 5 (Manchmal) | 10 (Ja) |
|---|---|---|---|---|
| 1 | Berührt eine unserer KI-Workloads Daten, die unsere VPC nicht verlassen dürfen? | 0 | 5 | 10 |
| 2 | Sind wir in einer regulierten Branche (Gesundheit, Finanzen, Verteidigung, Behörden)? | 0 | 5 | 10 |
| 3 | Haben wir proprietäres IP/Prompts/Tooling, das wir nicht mit einem Vendor teilen wollen? | 0 | 5 | 10 |
| 4 | Werden wir innerhalb von 12 Monaten >25 tägliche KI-Benutzer haben? | 0 | 5 | 10 |
| 5 | Benötigen wir MCP-Server, die Anthropic nicht liefert? | 0 | 5 | 10 |
| 6 | Projizieren wir >200 K $/Jahr an Cowork-Lizenzkosten? | 0 | 5 | 10 |
| 7 | Brauchen wir Agenten-Orchestrierung über Coworks Scheduling-Primitive hinaus? | 0 | 5 | 10 |
Wir haben diese Matrix über 30+ KI-Integrationsprojekte der letzten 18 Monate angewendet. Der Anteil der Organisationen, die über 25 punkten, ist von rund 30 % Ende 2024 auf etwa 55 % im Mai 2026 gestiegen — getrieben hauptsächlich von GDPR-Durchsetzung und der SEC-Regel zur KI-Offenlegung von 2025. Die Verschiebung ist nicht ideologisch; sie ist regulatorisch.
Ein bemerkenswertes Muster: Scores neigen dazu, sich an den Extremen zu sammeln. Unternehmen punkten entweder 5–15 (Cowork ist offensichtlich richtig) oder 35–70 (selbstgehostet ist offensichtlich richtig). Das 15–25-Mittelband ist seltener, als es aussieht, und repräsentiert meist Unternehmen kurz davor, eine regulatorische Linie zu überschreiten, die sie noch nicht bemerken.
Wann Cowork sogar im Enterprise-Maßstab gewinnt
Selbst in Unternehmen, die über 50 auf der Matrix punkten, gewinnt Cowork weiterhin für drei Muster: das nicht-regulierte Marketing-Team, den 90-Tage-Prototype-then-Buy und das Bolt-on für reife interne KI-Plattformen. Alles selbst zu hosten ist genauso falsch wie alles zu kaufen; die Kunst ist, jeden Workflow zum richtigen Stack zu routen.
Die drei Muster:
-
Das nicht-regulierte Marketing-Team in einem regulierten Unternehmen. Ein Pharma-Unternehmen kann keine PHI auf Cowork legen, aber sein Brand-Marketing-Team berührt keine PHI — es schreibt Kampagnen-Briefings und analysiert Kanal-Performance. Cowork ist dort okay. Low-Sensitivity-Arbeit zu Cowork und High-Sensitivity-Arbeit zum internen Stack zu routen, ist die offensichtliche, aber selten umgesetzte Architektur, und wir behandeln die Frage zur Ersetzung von Marketing-Managern anderswo im Detail.
-
Prototype-then-Buy-Muster. Verwenden Sie Cowork für 60–90 Tage, um zu beweisen, dass der Workflow auf echten Daten und echten Anwendern funktioniert. Wenn ROI auftaucht, dann bauen. Wenn nicht, haben Sie 20 K $ für Cowork-Plätze ausgegeben statt 200 K $ für einen Build, der ein Problem löst, das Sie nicht hatten. Der 90-Tage-Cowork-Pilot ist die qualitativ hochwertigste Anforderungserhebungsübung in Enterprise-KI.
-
Reife Unternehmen mit bereits bestehenden internen KI-Plattformen. Wenn Sie den 7-Schichten-Stack bereits für High-Sensitivity-Arbeit gebaut haben, ist das Anschnallen von Cowork an die Low-Sensitivity-Oberfläche schnell, günstig und reduziert das "Shadow IT"-Risiko, dass Teams KI-Tools eigenständig adoptieren.
Coworks SMB-Sweet-Spot gilt auch innerhalb von Unternehmen — für jedes Sub-Team, das wie ein kleines Unternehmen operiert, ist Cowork strukturell das richtige Werkzeug, unabhängig vom regulatorischen Profil der Muttergesellschaft.
Selbstgehostet ist die richtige Antwort für sensible Workloads. Cowork ist die richtige Antwort für alles andere. Die Kunst ist, zu wissen, welches welches ist — und nicht zu tun, als wäre es binär.
Wie Techsy Enterprise-KI-Integrationen baut
Wir haben seit 2024 mehr als 30 KI-Integrationsprojekte in regulierten Finanzen, Gesundheits-nahem, Verteidigungs-nahem und IP-sensiblen Konsumgütermarken ausgeliefert. Die Methodologie hat sich nicht stark geändert, weil sich die Architektur nicht stark geändert hat — es sind die gleichen sieben Schichten, individuell angepasst pro regulatorischem Profil.
Die vier-Phasen-Methodologie:
-
Phase 1 — Architektur- und TCO-Workshop (2 Wochen, Festpreis). Wir bewerten die Entscheidungsmatrix mit Ihrem Team, entwerfen die 7-Schichten-Architektur für Ihre Constraints und bauen das ehrliche TCO-Modell. Sie gehen mit einem funktionierenden Artefakt heraus, unabhängig davon, ob Sie uns für Phase 2 beauftragen.
-
Phase 2 — Referenz-Build (8–12 Wochen). Ein produktiver Agent auf dem vollen 7-Schichten-Stack — typischerweise der wertvollste, politisch unproblematischste Workflow, den wir in Phase 1 identifiziert haben. Produktionsreif, kein Demo. Wir nutzen das Anthropic Agent SDK und das $500-Guthaben, das wir hier behandeln, um frühe Layer-4-Arbeit zu subventionieren, wo es passt.
-
Phase 3 — Plattform-Expansion (3–6 Monate). Agenten 2 bis N auf dem gleichen Stack. Hier kollabieren die Grenzkosten jedes neuen Agenten — meist 30–60 % der Kosten des Phase-2-Referenz-Builds. Der 7-Schichten-Stack wird zur Plattform.
-
Phase 4 — Übergabe und Betrieb (laufend). Ihr Team besitzt den Stack. Wir bleiben auf Retainer für Modell-Upgrades, neue MCP-Server und vierteljährliche Architektur-Reviews.
Der Stack, den wir 2026 standardmäßig ausliefern: Anthropic Claude Opus 4.7 + LangGraph + Pinecone (oder Qdrant für vollständiges On-Premise) + LiteLLM-Gateway + vLLM für On-Premise-Inferenz-Pfade, hinter OPA-Policy-RBAC und OpenTelemetry-Observability. Jede Komponente ist austauschbar; nichts ist eigens nur des Eigenseins willen. Die agentische KI-Deployment-Plattform, die wir verwenden, bündelt diesen Stack zu einer deploybaren Oberfläche, und unsere Agent-Development-Praxis behandelt das Engineering-Modell im Detail.
Wenn Sie die Matrix gemeinsam bewerten und sehen möchten, wie Ihre 7-Schichten-Architektur aussehen würde, buchen Sie ein kostenloses 30-Minuten-Architektur-Gespräch mit unserem Team. Keine Voraussetzungen, keine Folien — wir gehen Ihre Constraints durch und skizzieren den Stack live.
Beobachten wir das Produkt, das wir respektvoll kritisieren
Anthropic hat ein wirklich gutes Produkt ausgeliefert. Die nächsten dreizehn Minuten sind Ihre Zeit wert — es ist die klarste Artikulation dessen, wofür Cowork da ist, vom Team, das es gebaut hat.
Schauen Sie es sich an, bevor Sie sich auf einen Pfad festlegen. Wenn Sie danach denken, Cowork löst Ihr Problem — kaufen Sie Cowork. Wenn Sie sich dabei ertappen, "das ist toll, aber..." zu denken, dann ist die zweite Hälfte dieses Beitrags für Sie. Wir sind nicht Anti-Cowork. Wir sind Anti-Falsches-Tool-für-Ihr-Regulatorisches-Profil.
Migrationspfad — Vom Cowork-Pilot zur selbstgehosteten Produktion
Das häufigste Muster, das wir 2026 sehen, ist nicht Cowork-oder-selbstgehostet. Es ist Cowork-dann-selbstgehostet, mit einem klaren Migrationsplan. Hier ist der vier-stufige Pfad, den wir empfehlen:
- Monate 0–3 — Cowork-Pilot. Beweisen Sie den Workflow auf echten Anwendern mit echten Daten (nur Low-Sensitivity-Workflows). Dokumentieren Sie, was funktioniert, was nicht und was Sie anders haben wollen.
- Monate 3–4 — Architektur-Entscheidung. Bewerten Sie die Matrix mit den Daten aus Phase 1. Wenn Sie über 25 punkten, committen Sie sich auf den Build. Schalten Sie Cowork noch nicht ab.
- Monate 4–10 — Parallel-Build. Bauen Sie den 7-Schichten-Stack parallel zum fortgesetzten Cowork-Einsatz. Die nicht-sensiblen Workflows bleiben auf Cowork; der Build zielt auf die regulierten Workflows.
- Monate 10–12 — Cut-over per Workflow, nicht per Abteilung. Sensible Workflows wandern zuerst auf selbstgehostet; nicht-sensible Workflows können auf Cowork bleiben, solange das Routing sinnvoll ist.

Die Cut-over-Regel ist das, was die meisten Teams falsch machen. Migration per Abteilung erzeugt ein politisches Zwangsmarsch-Problem; Migration per Workflow-Typ lässt jedes Team das richtige Werkzeug für die Arbeit vor sich adoptieren. Die Entscheidungsmatrix bewertet pro Workflow, nicht pro Abteilung — aus dem gleichen Grund.
Wir haben auch das umgekehrte Muster gesehen — selbstgehostet-dann-Cowork — bei Unternehmen, die früh gebaut haben und jetzt ihren nicht-regulierten Teams eine schnelle Oberfläche geben wollen. Der Vergleich mit ChatGPT Agents ist die richtige Referenz, wenn Sie zwischen Cowork und einem konkurrierenden Buy-Side-Produkt feststecken, nachdem Sie sich für eine hybride Architektur entschieden haben.
FAQ
Ist es nicht viel teurer, selbst zu bauen?
Nicht immer und selten einfach. Bei 200 Plätzen gewinnt Cowork auf fünf Jahre kostenmäßig. Zwischen 600 und 800 Plätzen überschneiden sich die Kurven, und bei 1.000+ Plätzen ist selbstgehostet günstiger. Wichtiger: Wenn Sie 25+ auf der Entscheidungsmatrix punkten, ist der Kostenvergleich akademisch — regulatorische oder Souveränitätsanforderungen haben die Entscheidung bereits getroffen.
Wie lange dauert es, einen selbstgehosteten Enterprise-Agent-Stack auszuliefern?
8–12 Wochen für den ersten produktiven Agenten auf dem vollständigen 7-Schichten-Stack, 3–6 Monate für die Plattform (Agenten 2 bis N) und laufend für das Modell-Upgrade-Tretmühle. Cowork liefert in 1–2 Wochen. Die meisten Unternehmen tauschen das 8-Wochen-Delta gegen Souveränität und Anpassung; diejenigen, die das nicht tun, waren keine Unternehmen, die bauen mussten.
Können wir mit Cowork anfangen und später migrieren?
Ja — das ist das häufigste Muster, das wir 2026 sehen. Verwenden Sie Cowork in Monaten 0–3, um den Workflow zu beweisen, bauen Sie den 7-Schichten-Stack parallel in Monaten 4–10 und schalten Sie dann per Workflow-Typ statt per Abteilung um. Die Migration ist schwieriger als am Tag eins selbstgehostet anzufangen, aber viel schneller als blind zu bauen.
Was ist mit Claude Enterprise's Trust Center?
Anthropics Trust Center deckt SOC 2 Typ II, ISO 27001, EU-Datenresidenz auf Enterprise und BAA für das Gesundheitswesen ab. Es ist eine starke Story für das, was es abdeckt. Es deckt nicht ITAR, IL5/IL6-Sovereign-Cloud-Anforderungen, M&A-Deal-Room-hermetische Isolation oder Workflows ab, in denen der Prompt-Inhalt selbst klassifiziert oder reguliert ist. Trust Center ist für manche Szenarien notwendig und für andere strukturell unzureichend.
Ist On-Premise-Deployment von Anthropic-Modellen erlaubt?
Nein. Anthropic liefert keine Claude-Modellgewichte aus, daher ist echte On-Premise-Inferenz von Claude 2026 unmöglich. On-Premise-Selbsthosting erfordert Open-Weight-Alternativen — Llama 3.3, DeepSeek V3, Qwen 3 oder Mistral Large auf vLLM. Bedrock und Vertex bieten Private-Endpoint-Optionen, die einige Regulierer als praktisches Äquivalent zu On-Premise akzeptieren; klären Sie das mit Ihrem Compliance-Team, bevor Sie das annehmen.
Was sind die laufenden Wartungskosten über die Zeit?
Rund 250 K $/Jahr für ein 2-Personen-Ops-Team plus Modellnutzung und Infrastruktur im 200-Platz-Maßstab. Diese Zahl steigt auf etwa 325 K $/Jahr bei 1.000 Plätzen — die meisten Kosten sind fixes Engineering, nicht variable Infrastruktur. Modellnutzung skaliert mit Anwendern, komprimiert sich aber durch Batching, Caching und Routing kleinerer Anfragen zu günstigeren Modellen über die Gateway-Schicht.
Wer besitzt die Prompts und das Tooling, das wir entwickeln?
Sie tun das, vollständig, auf einem selbstgehosteten Stack. Auf Cowork werden Prompts in Anthropics Infrastruktur unter deren kommerziellen Bedingungen gespeichert — für die meisten Unternehmen okay, ein Dealbreaker für IP-sensible Branchen (Konsumgütermarken, Biotech, regulierte Finanzen). Die Eigentums-Story ist einer der unterschätzten Gründe, warum reife Unternehmen selbsthosten.
Unterstützen Sie hybrid — einige Workflows auf Cowork, andere selbstgehostet?
Ja, und wir empfehlen es öfter als reines Selbsthosting. Routen Sie Low-Sensitivity-Workflows zu Cowork und High-Sensitivity-Workflows zu Ihrem internen Stack. Ein LiteLLM-Gateway kann mit einfachen Routing-Regeln nach Workflow-Typ ausfächern, und Ihre Audit- und Policy-Schichten können beide Oberflächen einheitlich behandeln.
Wie handhaben Sie die Modell-Upgrade-Tretmühle auf einem selbstgehosteten Stack?
Das LiteLLM-Gateway abstrahiert die Modellwahl. Wenn Anthropic ein neues Modell ausliefert, zeigen Sie eine Konfiguration darauf. Wenn ein Open-Weight-Modell den Closed-Source-Incumbent auf einer spezifischen Aufgabe überholt, leiten Sie diese rechenintensive Workload zu vLLM um, ohne Anwendungscode anzufassen. Die 7-Schichten-Architektur ist explizit darauf ausgelegt, Sie vor Modell-Lock-in zu schützen — was Cowork strukturell nicht kann.
Abschluss
Cowork ist ein großartiges Produkt für die Arbeit, für die es gebaut ist, und es ist nicht die richtige Antwort für regulierte Unternehmen mit Souveränitäts-, IP- oder maßgeschneiderten Orchestrierungs-Constraints. Die 7-Schichten-selbstgehostete Referenzarchitektur in diesem Beitrag ist dieselbe, die wir seit 2024 über 30-mal ausgeliefert haben; die Entscheidungsmatrix ist das Artefakt, durch das wir jeden Kunden in Phase 1 führen. Lesen Sie den vollständigen Cowork-Leitfaden, falls noch nicht geschehen, und kommen Sie dann hierher zurück, wenn Sie bereit sind, über Architektur zu sprechen.
Wenn Sie eine funktionierende Version der Entscheidungsmatrix und einen Architektur-Entwurf für Ihre Constraints möchten, melden Sie sich — wir skizzieren es live, und Sie gehen mit dem Artefakt heraus, unabhängig davon, ob wir danach zusammenarbeiten.