
Giải pháp thay thế Claude Cowork: Vì sao doanh nghiệp bị quản lý chặt tự xây dựng hệ thống AI Coworker riêng (2026)
Nếu bạn đã đọc hướng dẫn đầy đủ về Cowork của chúng tôi và linh cảm mách bảo rằng nó không thể chạm vào các quy trình làm việc nhạy cảm nhất của bạn, thì có lẽ bạn đúng. Claude Cowork cực kỳ phù hợp với đúng loại công việc mà nó được thiết kế, và không phù hợp với những công việc bị quản lý chặt, tùy biến, ràng buộc về chủ quyền vốn lấp đầy lịch làm việc của doanh nghiệp. Dưới đây là phân tích thẳng thắn, kiến trúc tham chiếu và bài toán TCO.
Nơi Claude Cowork thực sự xuất sắc
Cowork là câu trả lời đúng khi công việc của bạn dựa trên dữ liệu không nhạy cảm, đội ngũ của bạn có từ 5 đến 500 người, và bạn thà triển khai trong hai tuần còn hơn hai quý. Anthropic đã làm rất tốt trải nghiệm UX AI-coworker cho đối tượng đó, và bốn gói dọc (vertical bundle) được phát hành trong sáu tuần qua chứng minh họ đang đầu tư vào nó như một sản phẩm dài hạn, chứ không phải một canh bạc phụ.
Ba điểm mạnh của Cowork được ghi nhận rõ trong cụm của chúng tôi:
- Vận hành marketing, bản brief nội dung, nghiên cứu khán giả, điều phối đa kênh. Chợ plugin và các primitive lập lịch của Cowork ánh xạ gọn gàng vào cách các đội marketing thực sự làm việc. Xem bài phân tích chuyên sâu về marketing-ops của chúng tôi để biết các mẫu quy trình.
- Đội pháp chế, phân loại hợp đồng, rà soát redline, nghiên cứu theo khu vực pháp lý. Gói Legal mà Anthropic phát hành ngày 12 tháng 5 là gói dọc đầu tiên và đến nay vẫn là gói chỉn chu nhất. Chúng tôi đã đi qua các use case trong bài phân tích cho đội pháp chế.
- Doanh nghiệp nhỏ và vừa, xuất hóa đơn, chăm sóc khách hàng tiếp theo, báo cáo nhẹ. Gói SMB (13 tháng 5) thực sự tốt cho các công ty dưới ~250 nhân viên, những nơi không có CISO giám sát gắt gao. Bài đánh giá SMB của chúng tôi đi vào chi tiết.
Anthropic cũng xác nhận Financial Services là gói dọc tiếp theo, và stack Managed Agents được công bố tại Code w/ Claude ngày 11 tháng 5 nâng trần những gì chợ plugin của Cowork có thể làm. Không có gì phải nghi ngờ về những điều đó.
Cowork là câu trả lời đúng cho hầu hết các công ty trong hầu hết thời gian. Bài viết này nói về phần còn lại, thiểu số bị quản lý chặt, ràng buộc chủ quyền, nặng về IP độc quyền, nơi Cowork là công cụ sai, ngay cả khi nó là một sản phẩm tuyệt vời.
8 kịch bản doanh nghiệp nơi Cowork chạm giới hạn
Tám quy trình làm việc phân tách "Cowork vẫn ổn" với "Cowork là bất khả thi": yêu cầu về nơi lưu trú dữ liệu GDPR, PHI y tế, bảo mật quốc phòng/chính phủ, bảo mật phòng giao dịch M&A, tài chính bị quản lý theo SEC/FINRA, bảo vệ IP độc quyền, phạm vi MCP-server tùy chỉnh vượt ngoài ~20 gói mà Anthropic phát hành, và các mẫu điều phối agent mà Anthropic chưa thiết kế. Mỗi yếu tố trong số này là một cổng có/không, không phải sở thích.
| Kịch bản | Vì sao Cowork chưa đáp ứng | Self-hosted mang lại cho bạn điều gì |
|---|---|---|
| Nơi lưu trú dữ liệu GDPR | Cowork Enterprise cung cấp nơi lưu trú dữ liệu EU nhưng không ghim hoàn toàn vào một vùng duy nhất cho tất cả các bộ xử lý phụ và đường dẫn mô hình. Telemetry xuyên biên giới khó kiểm toán. | Suy luận ghim theo vùng (Bedrock EU, Vertex EU, on-prem) cộng với DLP đầy đủ ở mọi lớp; danh sách bộ xử lý phụ là của riêng bạn. |
| PHI y tế | BAA của Anthropic bao phủ endpoint mô hình, không bao phủ các lệnh gọi công cụ hạ nguồn của khách hàng hay plugin bên thứ ba từ chợ. Sự phình to plugin phá vỡ phạm vi HIPAA. | Cô lập PHI hoàn toàn qua hạ tầng cách ly theo tenant, mọi MCP server được kiểm toán theo BAA của bạn, prompt và phản hồi được ghi log với kiểm soát lưu trữ do bạn đặt. |
| Bảo mật quốc phòng / chính phủ | ITAR, IL5/IL6 và các chuẩn tương đương yêu cầu triển khai trên đám mây chủ quyền hoặc on-prem. Cowork là SaaS. | vLLM hoặc Llama 3.3 tự host trên GovCloud, phần cứng đạt chuẩn IL5 hoặc on-prem. Các mô hình trọng số đóng của Anthropic không thể chạy ở đây. |
| Bảo mật phòng giao dịch M&A | Các prompt mô tả điều khoản giao dịch không bao giờ được rời khỏi VPC của phòng giao dịch. Plugin chợ và tính năng bộ nhớ toàn cầu của Cowork không tương thích về mặt cấu trúc. | Stack khép kín cho từng thương vụ trên hạ tầng tạm thời, sẽ bị xóa sạch khi thương vụ hoàn tất. Không có bộ nhớ chia sẻ giữa các thương vụ. |
| Tài chính bị quản lý (SEC, FINRA) | Quy tắc Công bố AI 2025 của SEC coi nội dung prompt dùng trong quyết định giao dịch hoặc đầu tư là hồ sơ bị quản lý. Cowork không cung cấp log kiểm toán prompt bất biến. | Log kiểm toán lưu trữ WORM ở lớp gateway, băm mật mã ở cấp prompt, móc giám sát theo Điều 14 MAR. |
| Bảo vệ IP độc quyền | Prompt, công cụ tùy chỉnh và dữ liệu huấn luyện nằm trong hạ tầng của Anthropic theo điều khoản thương mại của họ. Ổn với hầu hết; chí mạng với các thương hiệu tiêu dùng và công nghệ sinh học nhạy cảm về IP. | Mọi prompt, công cụ và fine-tune đều nằm trên hạ tầng bạn kiểm soát. Không có gì về hoạt động của bạn rò rỉ cho bên thứ ba. |
| Phạm vi MCP-server tùy chỉnh | Anthropic phát hành khoảng 20 MCP server bên thứ nhất và kiểm duyệt chợ. Doanh nghiệp thường cần 100–300 tích hợp nội bộ (Snowflake, Workday, data lake nội bộ, SAP kế thừa). | Bạn xây các MCP server mình cần theo đặc tả Model Context Protocol. Không có người gác cổng chợ, không phải chờ quan hệ đối tác nhà cung cấp của Anthropic. |
| Điều phối agent vượt ngoài lịch | Các primitive lập lịch của Cowork rất tuyệt cho "chạy việc này mỗi thứ Hai." Chúng không được xây cho đồ thị giám sát đa agent, guardrail tất định, hay cổng phê duyệt có con người trong vòng lặp. | LangGraph hoặc CrewAI cho bạn giám sát đồ thị đầy đủ, định tuyến có điều kiện, chính sách thử lại và bàn giao có cấu trúc. |
Nếu bạn đọc bảng đó và có hai hàng trở lên mô tả doanh nghiệp của mình, bạn đã vượt qua ranh giới Cowork-vẫn-ổn. Đọc tiếp.
Kiến trúc tham chiếu Coworker tự host
Một stack AI coworker tự host trong production có bảy lớp: suy luận (inference), gateway, bộ nhớ, điều phối agent, công cụ (MCP server), RBAC/kiểm toán, và UI. Mỗi lớp có hai hoặc ba lựa chọn thực sự vào năm 2026, và stack đủ khả năng kết hợp để bạn có thể thay bất kỳ lớp nào mà không phải viết lại các lớp khác. Dưới đây là chức năng của từng lớp, những gì chúng tôi dùng thường nhất, và những gì cần lưu ý.

Lớp 1 — Suy luận (mô hình)
Đây là nơi LLM thực sự chạy. Bạn có bốn con đường thực tế:
- API Anthropic trực tiếp, nhanh nhất, ít overhead kỹ thuật nhất, nhưng bạn lại quay về đường dẫn dữ liệu của Anthropic. Ổn nếu mối lo của bạn là điều phối tùy chỉnh chứ không phải nơi lưu trú dữ liệu.
- OpenRouter, một API duy nhất cho hơn 100 mô hình. Tuyệt cho phát triển và thử nghiệm so sánh mô hình, kém tuyệt hơn cho kiểm toán doanh nghiệp.
- Bedrock hoặc Vertex AI, endpoint riêng tư cloud-native với ghim vùng. Anthropic Claude có sẵn trên cả hai. Đây là thỏa hiệp doanh nghiệp phổ biến nhất: bạn có chất lượng đẳng cấp Claude với tuân thủ cloud-native.
- Suy luận on-prem, vLLM trên phần cứng H100/H200 chạy các mô hình trọng số mở. Llama 3.3 70B, DeepSeek V3, Qwen 3, hoặc Mistral Large. Con đường duy nhất cho IL5/IL6 và đắt nhất về capex.
Anthropic không phát hành trọng số mô hình Claude, nên on-prem thực sự với Claude là bất khả thi. Nếu bạn buộc phải on-prem, bạn chọn từ các mô hình trọng số mở, và khoảng cách chất lượng với Claude Opus 4.7 đã thu hẹp đáng kể trong 18 tháng qua nhưng chưa khép lại.
Lớp 2 — LLM Gateway
Gateway nằm giữa mọi ứng dụng và mọi mô hình. Nhiệm vụ của nó là failover, định tuyến chi phí, ghi log kiểm toán, giới hạn tốc độ, và (quan trọng) trừu tượng hóa việc chọn mô hình để bạn có thể đổi đường suy luận mà không chạm vào code ứng dụng.
Các lựa chọn production:
- LiteLLM, mã nguồn mở, tự host được, API tương thích OpenAI trên hơn 100 nhà cung cấp. Miễn phí.
- Portkey, gateway được quản lý với dashboard quan sát tích hợp. Tốt cho các đội không muốn tự vận hành LiteLLM.
- Helicone, ưu tiên quan sát; kết hợp tốt với LiteLLM thay vì thay thế nó.
Lớp này là không thể thương lượng trong production. Bỏ qua nó nghĩa là hardcode việc chọn mô hình vào ứng dụng của bạn, rồi phải deploy lại mỗi khi Anthropic phát hành mô hình mới hoặc đội bảo mật của bạn yêu cầu failover theo vùng.
Lớp 3 — Bộ nhớ và Truy xuất
Ba hệ thống con nằm ở đây:
- Vector store, Pinecone (quản lý, con đường nhanh nhất) hoặc Qdrant (tự host được, lựa chọn đúng cho yêu cầu on-prem). Weaviate và pgvector cũng hợp lệ; Qdrant hiện có câu chuyện doanh nghiệp sạch sẽ nhất.
- Bộ nhớ có cấu trúc, Postgres cho bất cứ thứ gì hưởng lợi từ SQL. Hầu hết "bộ nhớ agent" thực ra là quan hệ, không phải ngữ nghĩa.
- Ngữ cảnh ngắn hạn, Redis hoặc DynamoDB cho trạng thái phiên, cache hội thoại gần đây, và kết quả agent trung gian.
Làm đúng lớp này và các agent của bạn có cảm giác như chúng nhớ mọi thứ. Làm sai và mọi cuộc hội thoại bắt đầu từ số không, ổn cho chatbot và chí mạng cho coworker.
Lớp 4 — Điều phối Agent
Đây là nơi các primitive lập lịch của Cowork không còn đủ. Các lựa chọn:
- LangGraph, giám sát đa agent dựa trên đồ thị. Tốt nhất cho quy trình có định tuyến có điều kiện, thử lại và phê duyệt có con người trong vòng lặp.
- CrewAI, các nhóm agent theo vai trò. Trừu tượng sạch hơn cho các mẫu "nhà phân tích nghiên cứu + người viết + người phản biện".
- DAG tùy chỉnh, cho các đội có nền tảng hệ phân tán mạnh; cho bạn kiểm soát hoàn toàn với cái giá phải tự xây mọi thứ.
Với hầu hết doanh nghiệp, chúng tôi triển khai LangGraph vì mô hình đồ thị làm câu chuyện kiểm toán dễ hơn, mọi chuyển tiếp được ghi log, mọi quyết định có thể kiểm tra. (Và khoản tín dụng $500 của Anthropic Agent SDK mà chúng tôi đề cập ở đây thường trợ giá cho ba tháng đầu phát triển Lớp 4.)
Lớp 5 — Công cụ (MCP server)
Mọi tích hợp nội bộ trở thành một MCP server. Salesforce, Snowflake, Jira, Confluence, Workday, data lake của bạn, API HR nội bộ của bạn. Đặc tả Model Context Protocol hiện đã ổn định và có mặt trong mọi framework agent lớn. Bạn viết một server cho mỗi nguồn dữ liệu; lớp agent khám phá chúng lúc runtime.
Đây là lớp nơi chợ plugin của Cowork sụp đổ với doanh nghiệp. Anthropic kiểm duyệt chợ, chậm chạp, và theo lịch của họ. Lớp MCP tự host cho phép bạn phát hành server cho một module SAP kế thừa trong một tuần, không phải một quý. Chúng tôi thường xây 15–40 MCP server cho mỗi dự án doanh nghiệp.
Lớp 6 — RBAC + Ghi log Kiểm toán
Đây là nơi các cơ quan quản lý quyết định stack của bạn có được phát hành hay không. Các thành phần:
- Policy engine, Open Policy Agent (OPA) hoặc AWS Cedar. Mọi lệnh gọi công cụ và mọi lệnh gọi mô hình đều đi qua đánh giá policy. Theo từng người dùng, từng vai trò, từng lớp dữ liệu.
- Pipeline kiểm toán, mọi prompt, mọi phản hồi, mọi lệnh gọi công cụ, mọi mô hình được chọn, mọi chi phí phát sinh, đều được ghi log với lưu trữ đầy đủ. Chúng tôi dùng trace OpenTelemetry chảy vào SIEM trên đám mây bị quản lý hoặc kho lưu trữ S3 dài hạn với tuân thủ WORM.
- Phát hiện PII/PHI, Presidio hoặc pipeline DLP tùy chỉnh tại gateway. Che (redact) trước khi ghi log; không bao giờ để PHI thô chạm vào kho kiểm toán của bạn.
Lớp này vô hình với người dùng cuối và là lý do doanh nghiệp thực sự trả tiền cho việc xây dựng. Nó cũng là lớp mà Cowork không thể cung cấp cho bạn, về mặt cấu trúc, vì ranh giới kiểm toán không bao gồm hạ tầng của họ.
Lớp 7 — UI
Lợi thế ứng dụng desktop mà Cowork có ở Lớp 7 hầu như biến mất với doanh nghiệp, vì hầu hết người dùng doanh nghiệp dù sao cũng sống trong Slack, Microsoft Teams, hoặc một cổng web tùy chỉnh. Các lựa chọn UI thực tế:
- Bot Slack hoặc Teams, con đường nhanh nhất để được chấp nhận trong quy trình hiện có.
- Ứng dụng web tùy chỉnh, Next.js hoặc cổng nội bộ hiện có của bạn, với bề mặt agent nhúng.
- Ứng dụng desktop tùy chỉnh, Electron vẫn là câu trả lời thực tế nếu bạn muốn trải nghiệm "tab thứ ba" kiểu Cowork. Hầu hết doanh nghiệp không cần nó.
Chọn bất kỳ bề mặt nào người dùng của bạn đã sống trong đó. Lập luận khóa mô hình ở đây là ngược với Cowork: thay vì buộc người dùng vào một ứng dụng mới, stack của bạn gặp họ ở nơi họ đang ở.
Đó là stack 7 lớp, không phải dự án cuối tuần. Hai phần tiếp theo định lượng chi phí và thời gian.
TCO 5 năm, Ghế Cowork so với Stack tự host
Ở 200 ghế, Cowork Enterprise thắng về chi phí. Ở 1.000+ ghế trong năm năm, bản build tự host sụp xuống khoảng $2/ghế/ngày tính tổng, và vượt TCO của Cowork ở đâu đó giữa 600 và 800 ghế. Tuy nhiên, điểm giao đó chỉ quan trọng nếu không có cổng nào khác (nơi lưu trú dữ liệu, điều phối tùy chỉnh, IP) đã buộc phải build. Với hầu hết doanh nghiệp bị quản lý, so sánh TCO là phép kiểm tra tính hợp lý, không phải yếu tố quyết định.
"5-Year TCO: Cowork Enterprise vs. Self-Hosted (200 seats)"
Bảng dữ liệu
| "Sourcing Option" | "5-Year Total" |
|---|---|
| "Cowork (200 seats × $60/mo)" | 720 |
| "Self-Hosted (200 seats, build + 4yr ops)" | 1850 |
| "Self-Hosted (1,000 seats, amortised)" | 2150 |
Các giả định đằng sau những con số đó, vì các bài TCO giấu giả định thì vô dụng:
- Cowork Enterprise, giá niêm yết $60/ghế/tháng cho hạng Enterprise với tiện ích bổ sung cư trú EU và BAA, ×200 ghế × 60 tháng = $720K. Không tính thêm tiện ích chợ.
- Tự host 200 ghế, chi phí build Năm 1 $850K (đội sáu kỹ sư trong hai quý, capex hạ tầng, vector store, stack quan sát), cộng vận hành Năm 2–5 ở mức $250K/năm (đội vận hành hai kỹ sư, mức dùng mô hình, opex hạ tầng). Tổng: $1,85M.
- Tự host 1.000 ghế, cùng chi phí build Năm 1 ($850K), vận hành Năm 2–5 tăng lên $325K/năm (mức dùng mô hình tăng theo người dùng; kỹ sư giữ gần như phẳng). Tổng: $2,15M, hay khoảng $2,15/ghế/ngày trung bình trong năm năm.
Dòng thú vị là dòng thứ ba. Chi phí kỹ sư trên stack tự host hầu như cố định, hai kỹ sư có thể duy trì một stack phục vụ 100 ghế hay 10.000. Mức dùng mô hình tăng theo người dùng nhưng nén lại khi bạn batch và cache. Điểm giao TCO với Cowork là có thật, nhưng nó xảy ra ở quy mô mà hầu hết doanh nghiệp chỉ đạt được nếu họ đẩy nền tảng qua nhiều bộ phận.
Nếu bạn ở 50 ghế và dữ liệu không bị quản lý, Cowork thắng trên mọi trục. Nếu bạn ở 5.000 ghế và có CISO, bản build tự host tự hoàn vốn trước Năm 3. Bài toán đảo ngược quanh 600–800 ghế, và hầu hết pilot doanh nghiệp nằm trong khoảng đó hoặc cao hơn.
Thời gian tạo giá trị, Đường cong khiến CFO ngạc nhiên
Cowork dùng được ở tuần đầu và đạt đỉnh ở tháng thứ hai. Tự host tăng chậm qua Q1, vượt Cowork khoảng tháng thứ sáu, và tiếp tục đi lên. Câu hỏi của CFO không phải "cái nào nhanh hơn", mà là "đường cong nào khớp với hồ sơ rủi ro và chân trời lập kế hoạch của chúng ta."
"Time-to-Value: Cowork vs. Self-Hosted (12 months)"
Bảng dữ liệu
| "Months" | "Cowork" | "Self-Hosted" |
|---|---|---|
| "M1" | 70 | 5 |
| "M2" | 80 | 15 |
| "M3" | 80 | 35 |
| "M4" | 80 | 55 |
| "M5" | 80 | 70 |
| "M6" | 80 | 80 |
| "M9" | 80 | 92 |
| "M12" | 80 | 100 |
Ba điều biểu đồ này nói chưa đủ:
-
Điểm Tháng 1 của Cowork cao vì nó là sản phẩm, không phải dự án. Anthropic đã phát hành UX và các tích hợp; bạn chấp nhận chúng. Khoảng cách 30 điểm ở Tháng 1 là thật, và nó quan trọng khi bạn đang cố chứng minh ROI AI cho một hội đồng quản trị đã nghe về nó hai năm.
-
Đường cong tự host không tuyến tính vì công việc không tuyến tính. Tháng 1–2 là kiến trúc, chọn nhà cung cấp, và hệ thống ống nước Lớp 1–2. Tháng 3–4 là những đợt phát hành agent thực sự đầu tiên trên stack. Tháng 5–6 là khi chi phí biên của agent số 5 giảm xuống một phần nhỏ của agent số một. Đó là điểm uốn, và là lý do việc xây nền tảng có cảm giác chậm đến bực bội trong 90 ngày đầu.
-
Đỉnh của Cowork là thật, không phải nói xấu. Cowork xuất sắc ở những gì Anthropic phát hành cho nó. Nó không được thiết kế để mở rộng vượt quá phạm vi đó, và chợ tồn tại chính xác để họ không phải tự mở rộng nó liên tục.
Chúng tôi đã đi qua cùng hình dạng đường cong trong bài phân tích build-vs-buy cho AI voice agent, các nguyên lý có thể chuyển giao. Nếu business case của bạn sống hay chết ở kết quả Tháng 3, hãy mua. Nếu nó sống ở kết quả Tháng 12, hãy build.
Ma trận quyết định Tự xây
Chấm bảy câu hỏi này 0, 5, hoặc 10. Nếu bạn đạt trên 25, hãy tự xây. Giữa 15 và 25, pilot Cowork và xem lại. Dưới 15, ở lại Cowork. Ma trận là phần có tín hiệu cao nhất của bài viết này; nếu bạn đánh dấu bất cứ thứ gì, hãy đánh dấu bảng này.
| # | Câu hỏi | 0 (Không) | 5 (Đôi khi) | 10 (Có) |
|---|---|---|---|---|
| 1 | Có workload AI nào của chúng ta chạm vào dữ liệu không thể rời VPC không? | 0 | 5 | 10 |
| 2 | Chúng ta có ở trong ngành bị quản lý (y tế, tài chính, quốc phòng, chính phủ)? | 0 | 5 | 10 |
| 3 | Chúng ta có IP/prompt/công cụ độc quyền không muốn chia sẻ với nhà cung cấp? | 0 | 5 | 10 |
| 4 | Chúng ta sẽ có >25 người dùng AI hàng ngày trong 12 tháng? | 0 | 5 | 10 |
| 5 | Chúng ta có cần MCP server mà Anthropic không phát hành? | 0 | 5 | 10 |
| 6 | Chúng ta có dự kiến >$200K/năm chi tiêu ghế Cowork? | 0 | 5 | 10 |
| 7 | Chúng ta có cần điều phối agent vượt ngoài primitive lập lịch của Cowork? | 0 | 5 | 10 |
Chúng tôi đã chạy ma trận này qua hơn 30 dự án tích hợp AI trong 18 tháng qua. Tỷ lệ tổ chức đạt trên 25 tăng từ khoảng 30% cuối 2024 lên khoảng 55% vào tháng 5/2026 — chủ yếu do thực thi GDPR và Quy tắc Công bố AI 2025 của SEC. Sự dịch chuyển không mang tính ý thức hệ; nó mang tính pháp lý.
Một mẫu đáng chú ý: điểm số có xu hướng tụ ở hai cực. Các công ty hoặc đạt 5–15 (Cowork rõ ràng đúng) hoặc 35–70 (tự host rõ ràng đúng). Dải giữa 15–25 hiếm hơn vẻ ngoài, và thường đại diện cho các công ty sắp vượt qua một ranh giới pháp lý mà họ chưa nhận ra mình đang tiến đến.
Khi Cowork vẫn thắng, ngay cả ở quy mô doanh nghiệp
Ngay cả bên trong các doanh nghiệp đạt 50+ trên ma trận, Cowork vẫn thắng ở ba mẫu: đội marketing không bị quản lý, prototype-90-ngày-rồi-mua, và phần gắn thêm cho nền tảng AI nội bộ trưởng thành. Tự host mọi thứ cũng sai như mua mọi thứ; kỹ năng là định tuyến mỗi quy trình vào đúng stack.
Ba mẫu:
-
Đội marketing không bị quản lý bên trong một doanh nghiệp bị quản lý. Một công ty dược không thể đặt PHI lên Cowork, nhưng đội marketing thương hiệu của họ không chạm vào PHI, họ viết brief chiến dịch và phân tích hiệu suất kênh. Cowork ổn ở đó. Định tuyến công việc ít nhạy cảm sang Cowork và công việc nhạy cảm cao sang stack nội bộ là kiến trúc hiển nhiên-nhưng-hiếm-khi-được-triển-khai, và chúng tôi đề cập câu hỏi thay thế quản lý marketing chi tiết ở nơi khác.
-
Mẫu prototype-rồi-mua. Dùng Cowork 60–90 ngày để chứng minh quy trình hoạt động trên dữ liệu thật và người dùng thật. Nếu ROI xuất hiện, thì build. Nếu không, bạn đã tiêu $20K cho ghế Cowork thay vì $200K cho một bản build giải quyết vấn đề bạn không có. Pilot Cowork 90 ngày là bài tập thu thập yêu cầu chất lượng cao nhất trong AI doanh nghiệp.
-
Doanh nghiệp trưởng thành đã có nền tảng AI nội bộ. Nếu bạn đã xây stack 7 lớp cho công việc nhạy cảm cao, gắn Cowork vào bề mặt ít nhạy cảm thì nhanh, rẻ, và giảm rủi ro "shadow IT" khi các đội tự áp dụng công cụ AI.
Điểm mạnh cho doanh nghiệp nhỏ của Cowork cũng áp dụng bên trong doanh nghiệp, cho bất kỳ đội con nào vận hành như một doanh nghiệp nhỏ, Cowork đúng về mặt cấu trúc là công cụ phù hợp, bất kể hồ sơ pháp lý của công ty mẹ.
Tự host là câu trả lời đúng cho workload nhạy cảm. Cowork là câu trả lời đúng cho mọi thứ khác. Kỹ năng là biết cái nào là cái nào, và không giả vờ rằng nó là nhị phân.
Cách Techsy xây dựng tích hợp AI doanh nghiệp
Chúng tôi đã phát hành hơn 30 dự án tích hợp AI từ 2024 trong tài chính bị quản lý, lân cận y tế, lân cận quốc phòng, và các thương hiệu tiêu dùng nhạy cảm về IP. Phương pháp luận không thay đổi nhiều vì kiến trúc không thay đổi nhiều, vẫn là bảy lớp đó, tùy chỉnh theo từng hồ sơ pháp lý.
Phương pháp luận bốn giai đoạn:
-
Giai đoạn 1 — Workshop kiến trúc và TCO (2 tuần, phí cố định). Chúng tôi chấm ma trận quyết định cùng đội của bạn, phác thảo kiến trúc 7 lớp cho các ràng buộc của bạn, và xây mô hình TCO trung thực. Bạn ra về với một artifact hoạt động bất kể bạn có thuê chúng tôi cho Giai đoạn 2 hay không.
-
Giai đoạn 2 — Build tham chiếu (8–12 tuần). Một agent production trên stack 7 lớp đầy đủ, thường là quy trình giá trị cao nhất, rủi ro chính trị thấp nhất mà chúng tôi xác định ở Giai đoạn 1. Sẵn sàng production, không phải demo. Chúng tôi dùng Anthropic Agent SDK và khoản tín dụng $500 mà chúng tôi đề cập ở đây để trợ giá công việc Lớp 4 giai đoạn đầu khi phù hợp.
-
Giai đoạn 3 — Mở rộng nền tảng (3–6 tháng). Agent 2 đến N trên cùng stack. Đây là nơi chi phí biên của mỗi agent mới sụp xuống, thường 30–60% chi phí của bản build tham chiếu Giai đoạn 2. Stack 7 lớp trở thành một nền tảng.
-
Giai đoạn 4 — Bàn giao và vận hành (liên tục). Đội của bạn sở hữu stack. Chúng tôi ở lại theo hợp đồng retainer cho nâng cấp mô hình, MCP server mới, và đánh giá kiến trúc hàng quý.
Stack chúng tôi phát hành mặc định vào 2026: Anthropic Claude Opus 4.7 + LangGraph + Pinecone (hoặc Qdrant cho on-prem hoàn toàn) + gateway LiteLLM + vLLM cho đường suy luận on-prem, đằng sau RBAC policy OPA và quan sát OpenTelemetry. Mọi thành phần đều thay thế được; không có gì bespoke vì mục đích bespoke. Nền tảng triển khai AI agentic mà chúng tôi dùng gói stack này thành một bề mặt triển khai được, và dịch vụ phát triển agent của chúng tôi đề cập mô hình kỹ thuật chuyên sâu.
Nếu bạn muốn chấm ma trận cùng nhau và xem kiến trúc 7 lớp của bạn sẽ trông như thế nào, đặt một cuộc gọi kiến trúc 30 phút miễn phí với đội của chúng tôi. Không cần điều kiện tiên quyết, không slide, chúng tôi đi qua các ràng buộc của bạn và phác thảo stack trực tiếp.
Theo dõi sản phẩm mà chúng tôi đang phê bình một cách tôn trọng
Anthropic đã phát hành một sản phẩm thực sự tốt. Mười ba phút tiếp theo đáng để bạn dành thời gian, đó là sự trình bày rõ ràng nhất về Cowork dùng để làm gì, từ đội đã xây dựng nó.
Hãy xem nó trước khi cam kết với một trong hai con đường. Nếu sau khi xem bạn nghĩ Cowork giải quyết vấn đề của bạn, hãy mua Cowork. Nếu bạn thấy mình đang nghĩ "tuyệt đấy, nhưng...", nửa sau của bài viết này dành cho bạn. Chúng tôi không chống Cowork. Chúng tôi chống việc mua sai công cụ cho hồ sơ pháp lý của bạn.
Lộ trình di chuyển, Từ Pilot Cowork đến Production tự host
Mẫu phổ biến nhất chúng tôi thấy năm 2026 không phải Cowork-hoặc-tự-host. Mà là Cowork-rồi-tự-host, với một kế hoạch di chuyển sạch. Đây là lộ trình bốn giai đoạn chúng tôi khuyến nghị:
- Tháng 0–3 — Pilot Cowork. Chứng minh quy trình trên người dùng thật với dữ liệu thật (chỉ quy trình ít nhạy cảm). Ghi lại những gì hoạt động, những gì thất bại, những gì bạn ước khác đi.
- Tháng 3–4 — Quyết định kiến trúc. Chấm ma trận với dữ liệu từ Giai đoạn 1. Nếu bạn đạt trên 25, cam kết build. Đừng tắt Cowork vội.
- Tháng 4–10 — Build song song. Xây stack 7 lớp song song với tiếp tục dùng Cowork. Quy trình không nhạy cảm ở lại Cowork; bản build nhắm vào quy trình bị quản lý.
- Tháng 10–12 — Chuyển đổi theo quy trình, không theo bộ phận. Quy trình nhạy cảm di chuyển sang tự host trước; quy trình không nhạy cảm có thể ở lại Cowork vô thời hạn nếu định tuyến hợp lý.
Quy tắc chuyển đổi là thứ hầu hết các đội làm sai. Di chuyển theo bộ phận tạo ra vấn đề chính trị kiểu hành quân cưỡng bức; di chuyển theo loại quy trình để mỗi đội áp dụng đúng công cụ cho công việc trước mắt. Ma trận quyết định chấm theo quy trình, không theo bộ phận, vì cùng lý do.
Chúng tôi cũng thấy mẫu ngược, tự-host-rồi-Cowork, ở các doanh nghiệp build sớm và giờ muốn cho các đội không bị quản lý một bề mặt nhanh. Bài so sánh với ChatGPT-Agents là tham chiếu đúng nếu bạn đang kẹt chọn giữa Cowork và một sản phẩm bên mua cạnh tranh sau khi cam kết kiến trúc hybrid.
FAQ
Tự xây có đắt hơn nhiều không?
Không phải luôn luôn, và hiếm khi đơn giản. Ở 200 ghế Cowork thắng về chi phí trong năm năm. Giữa 600 và 800 ghế các đường cong cắt nhau, và ở 1.000+ ghế tự host rẻ hơn. Quan trọng hơn: nếu bạn đạt 25+ trên ma trận quyết định, so sánh chi phí chỉ là học thuật, yêu cầu pháp lý hoặc chủ quyền đã quyết định thay bạn.
Mất bao lâu để phát hành stack agent doanh nghiệp tự host?
8–12 tuần cho agent production đầu tiên trên stack 7 lớp đầy đủ, 3–6 tháng cho nền tảng (agent 2 đến N), và liên tục cho vòng quay nâng cấp mô hình. Cowork phát hành trong 1–2 tuần. Hầu hết doanh nghiệp đánh đổi 8 tuần chênh lệch lấy chủ quyền và tùy chỉnh; những nơi không đánh đổi không phải doanh nghiệp cần build.
Chúng ta có thể bắt đầu với Cowork và di chuyển sau không?
Có, đây là mẫu phổ biến nhất chúng tôi thấy năm 2026. Dùng Cowork Tháng 0–3 để chứng minh quy trình, xây stack 7 lớp song song cho Tháng 4–10, rồi chuyển đổi theo loại quy trình thay vì theo bộ phận. Di chuyển khó hơn bắt đầu tự host từ ngày một nhưng nhanh hơn nhiều so với build mù quáng.
Còn Trust Center của Claude Enterprise thì sao?
Trust Center của Anthropic bao phủ SOC 2 Type II, ISO 27001, cư trú dữ liệu EU trên Enterprise, và BAA cho y tế. Đó là câu chuyện mạnh cho những gì nó bao phủ. Nó không bao phủ ITAR, yêu cầu đám mây chủ quyền IL5/IL6, cô lập khép kín phòng giao dịch M&A, hay quy trình mà bản thân nội dung prompt bị mật hoặc bị quản lý. Trust Center là cần thiết cho một số kịch bản và không đủ về mặt cấu trúc cho những kịch bản khác.
Triển khai on-prem mô hình Anthropic có được phép không?
Không. Anthropic không phát hành trọng số mô hình Claude, nên suy luận on-prem thực sự của Claude là bất khả thi năm 2026. Tự host on-prem yêu cầu các lựa chọn thay thế trọng số mở, Llama 3.3, DeepSeek V3, Qwen 3, hoặc Mistral Large chạy trên vLLM. Bedrock và Vertex cung cấp tùy chọn endpoint riêng tư mà một số cơ quan quản lý chấp nhận là tương đương thực tế với on-prem; hãy kiểm tra với đội tuân thủ của bạn trước khi giả định.
Chi phí bảo trì liên tục theo thời gian là bao nhiêu?
Khoảng $250K/năm cho đội vận hành 2 kỹ sư cộng mức dùng mô hình và hạ tầng ở quy mô 200 ghế. Con số đó tăng lên khoảng $325K/năm ở 1.000 ghế, phần lớn chi phí là kỹ sư cố định, không phải hạ tầng biến đổi. Mức dùng mô hình tăng theo người dùng nhưng nén lại khi bạn batch, cache, và định tuyến truy vấn nhỏ hơn sang mô hình rẻ hơn qua lớp gateway.
Ai sở hữu prompt và công cụ chúng ta phát triển?
Bạn, hoàn toàn, trên stack tự host. Trên Cowork, prompt được lưu trong hạ tầng của Anthropic theo điều khoản thương mại của họ, ổn với hầu hết công ty, là dealbreaker với các ngành IP độc quyền (thương hiệu tiêu dùng, công nghệ sinh học, tài chính bị quản lý). Câu chuyện sở hữu là một trong những lý do bị đánh giá thấp khiến doanh nghiệp trưởng thành tự host.
Bạn có hỗ trợ hybrid, một số quy trình trên Cowork, số khác tự host?
Có, và chúng tôi khuyến nghị nó thường xuyên hơn tự host thuần túy. Định tuyến quy trình ít nhạy cảm sang Cowork và nhạy cảm cao sang stack nội bộ. Gateway LiteLLM có thể phân tán theo loại quy trình với quy tắc định tuyến đơn giản, và các lớp kiểm toán và policy của bạn có thể xử lý hai bề mặt một cách thống nhất.
Bạn xử lý vòng quay nâng cấp mô hình trên stack tự host thế nào?
Gateway LiteLLM trừu tượng hóa việc chọn mô hình. Khi Anthropic phát hành mô hình mới, bạn chỏ một cấu hình vào nó. Khi một mô hình trọng số mở vượt mặt đối thủ mã nguồn đóng ở một tác vụ cụ thể, bạn chuyển hướng workload nặng tính toán đó sang vLLM mà không chạm vào code ứng dụng. Kiến trúc 7 lớp được thiết kế rõ ràng để bảo vệ bạn khỏi khóa mô hình, điều mà Cowork, theo thiết kế, không thể làm.
Kết luận
Cowork là sản phẩm tuyệt vời cho công việc mà nó được xây dựng, và nó không phải câu trả lời đúng cho doanh nghiệp bị quản lý với các ràng buộc chủ quyền, IP, hoặc điều phối tùy chỉnh. Kiến trúc tham chiếu tự host 7 lớp trong bài viết này là kiến trúc chúng tôi đã phát hành hơn 30 lần từ 2024; ma trận quyết định là artifact chúng tôi dẫn mọi khách hàng đi qua ở Giai đoạn 1. Đọc hướng dẫn đầy đủ về Cowork nếu bạn chưa đọc, rồi quay lại đây khi bạn sẵn sàng nói về kiến trúc.
Nếu bạn muốn một phiên bản hoạt động của ma trận quyết định và bản phác thảo kiến trúc 7 lớp cho các ràng buộc của bạn, hãy liên hệ, chúng tôi sẽ phác thảo trực tiếp và bạn ra về với artifact bất kể sau đó chúng ta có làm việc cùng nhau hay không.