Bỏ qua đến nội dung chính

Build a production-ready agent with Claude Managed Agents

TL;DR

  • Claude Managed Agents là một bộ API endpoint (dùng được với bất kỳ API key nào) cung cấp các agent sẵn sàng cho production cùng các primitive xung quanh — truy cập máy tính, credential vault, harness gọi tool, retry, memory, quản lý ngữ cảnh và multi-agent — để bạn chỉ phải xây lớp sản phẩm của riêng mình.
  • Bốn khối xây dựng cốt lõi là agent (template chứa system prompt, skill, tool, MCP server, kiểm soát quyền theo từng tool), environment (template sandbox với cấu hình mạng/package, hỗ trợ self-hosted sandbox trên Cloudflare/Modal/Vercel), session (cuộc hội thoại liên tục) và event (user, agent, session, span event được stream qua lại).
  • Demo trực tiếp xây dựng một web app "deal desk" từ starter repo bằng Anthropic SDK và skill Claude API tích hợp sẵn, minh họa liệt kê session, stream event, outcome (tự đánh giá theo spec), điều phối multi-agent và các view observability trực tiếp trong developer console.

Điểm chính

  • Dùng Claude Managed Agents để loại bỏ việc tự xây agent loop, hosting từ xa, lớp lưu trữ bền vững, đội sandbox và xác thực end-user — tất cả đều có sẵn out-of-the-box.
  • Định nghĩa agent như một template được phiên bản hóa: system prompt, các skill và tool, MCP server kết nối, và kiểm soát quyền theo từng tool (ví dụ tool đọc file tự chạy, còn bash hoặc gọi MCP database yêu cầu end-user phê duyệt rõ ràng).
  • Cấu hình environment như template sandbox: bật/tắt truy cập mạng, cài sẵn package NPM/pip, và mang sandbox tự host của riêng bạn (Cloudflare, Modal, Vercel) để dữ liệu riêng tư không rời khỏi VPC.
  • Khởi tạo session (cuộc hội thoại liên tục, tương đương chat mới trên claude.ai) từ một agent ID và environment ID, có thể preload sẵn GitHub repo và file vào container.
  • Tận dụng outcome: truyền một spec hoặc rubric, Claude làm bản triển khai đầu tiên rồi tự lặp và kiểm tra lại theo rubric đó cho đến khi đạt yêu cầu.
  • Bảo mật dữ liệu riêng bằng MCP tunnelcredential vault: Claude dùng MCP server nội bộ và token xác thực được tiêm vào mà chúng không bao giờ lọt vào ngữ cảnh của Claude hay bị lộ trên internet.
  • Giám sát trực tiếp qua developer console: nhấp vào một session đang chạy, quan sát các sub-agent được spawn trên các thread độc lập, kiểm tra input/output của từng tool, theo dõi độ trễ và đọc/sửa memory store.

Từ vựng

  • Claude Managed Agents — bộ API endpoint cung cấp agent sẵn sàng production và các primitive xung quanh
  • agent — template định nghĩa system prompt, skill, tool, MCP server và kiểm soát quyền
  • environment — template quy định cách sandbox container hoạt động
  • session — cuộc hội thoại liên tục giữa end user và Claude
  • outcome — spec/rubric mà Claude lặp lại và tự kiểm tra để thỏa mãn
  • credential vault — kho token xác thực MCP được Anthropic tiêm vào mà Claude không thấy
  • MCP tunnel — tunnel bảo mật cho phép Claude kết nối MCP server riêng tư
  • self-hosted sandbox — container tự host (Cloudflare, Modal, Vercel) thay cho sandbox của Anthropic
  • multi-agent — điều phối nhiều agent, mỗi agent có ngữ cảnh riêng

Nội dung chi tiết

Claude Managed Agents là gì

Claude Managed Agents ở mức cao chỉ đơn giản là một bộ API endpoint mà Anthropic đã phát triển và phát hành. Bạn có thể dùng chúng với bất kỳ API key nào ngay hôm nay, để có quyền truy cập các agent sẵn sàng cho production cùng tất cả các primitive xung quanh, rồi xây sản phẩm của riêng mình lên trên. Bạn chọn lấy các primitive cần thiết và bỏ phần còn lại.

Anthropic đã lo sẵn nhiều thứ: cho Claude truy cập máy tính, truy cập credential vault nếu bạn muốn tiêm xác thực MCP cho end-user của mình (ví dụ Claude cần truy cập Linear MCP của họ), harness gọi tool, retry và phục hồi lỗi trong production, cùng các primitive về memory, quản lý ngữ cảnh và multi-agent giúp bạn hưởng lợi từ mỗi thế hệ model mới. Ngoài ra, developer console còn có sẵn các view observability để debug trực tiếp những gì agent đang làm.

Bốn khối xây dựng cốt lõi

  • Agent: hãy coi nó như một template. Bạn muốn agent có một system prompt nhất định, truy cập các skill nhất định, và định nghĩa những tool nó được dùng. Một số agent được dùng tool bash và web search; số khác bạn cố tình không cho truy cập web để tránh bị prompt inject. Bạn cũng chọn các MCP server mà nó kết nối tới, và đặt kiểm soát quyền theo từng tool — ví dụ tool đọc file tự chạy, còn chạy bash hay gọi MCP database thì cần end-user phê duyệt.
  • Environment: định nghĩa template cho cách các sandbox của Claude hoạt động. Bạn quy định container có truy cập mạng hay không, cài sẵn package từ NPM hoặc pip. Với self-hosted sandbox mới ra mắt, bạn có thể mang sandbox riêng chạy trên Cloudflare, Modal, Vercel hoặc đội sandbox của chính mình, để dữ liệu riêng tư không rời khỏi VPC.
  • Session: một cuộc hội thoại liên tục giữa bạn và Claude, tương đương mở chat mới trên claude.ai hay vào Claude Code từ terminal. Bạn chỉ cần ID của agent và ID của environment để bắt đầu. Khi tạo session, bạn có thể đính kèm GitHub repo hoặc file để preload vào container.
  • Event: các session là luồng event liên tục, nơi bạn gửi message từ client và nhận lại phản hồi khi Claude xử lý.

Các loại Event

  • User event: message, hình ảnh, tài liệu, văn bản từ ứng dụng của bạn. Bạn cũng có thể gửi interrupt để cắt ngang khi Claude đi sai hướng, gửi kết quả của custom tool, hoặc xác nhận human-in-the-loop. Đặc biệt là outcome: bạn truyền một file hoặc đoạn văn bản như một spec, Claude làm bản triển khai đầu tiên rồi vào chế độ lặp và tự kiểm tra theo rubric cho đến khi thỏa mãn — một cách rất mạnh để chuẩn bị agent thành công.
  • Agent event: bất cứ điều gì Claude đang làm — message gửi về user, compaction khi ngữ cảnh quá lớn, các tool đang chạy (MCP hoặc tool agent mặc định), và event điều phối multi-agent khi Claude spawn các agent khác.
  • Session event: các event vòng đời cho biết trạng thái session đang thay đổi — vào retry loop, có lỗi, idle, hoặc terminate; cùng event xử lý outcome.
  • Span event: báo hiệu khi những thao tác dài bắt đầu và kết thúc (ví dụ Opus 4.7 sinh ra một tài liệu rất dài), để bạn biết hệ thống không bị treo.

Tính năng bảo mật nâng cao

Ngoài ra còn có self-hosted sandbox cho phép mang container riêng (Cloudflare, Vercel, Modal) để dữ liệu riêng tư không rời khỏi perimeter của bạn — Anthropic kết nối native và chỉ báo khi Claude cần sandbox mới.

MCP tunnel cho phép Claude kết nối an toàn tới các MCP server riêng tư trong mạng nội bộ của bạn qua một tunnel bảo mật, mà không bao giờ phơi bày các server đó ra internet. Đây là cách rất tiện để kết nối thêm nguồn dữ liệu riêng tư cho Claude.

Demo: xây dựng sản phẩm "Deal Desk"

Diễn giả xây một sản phẩm deal desk giả định (mua bán & sáp nhập), dùng tính năng multi-agent mới: nhiều agent với persona riêng — một agent lo xu hướng vĩ mô của ngành, một agent giỏi phân tích tài chính — đều là các thread riêng do agent chính khởi động.

Bắt đầu từ starter repo (dùng Bun), nhiều endpoint chưa được triển khai một cách cố ý để hướng dẫn cách dùng API:

  • Liệt kê session: dùng Anthropic SDK đã import, gọi client.beta.sessions.list và trả về dữ liệu — khá đơn giản.
  • Lấy session: trả về phản hồi từ get-session, hiển thị agent, các tool có sẵn, kết nối Linear MCP.
  • Chat view: gồm gửi session event và endpoint streaming. Phần phức tạp này được giao cho Claude — vì Claude Code mặc định có sẵn skill Claude API, giúp Claude rất giỏi dùng các API managed agents. Diễn giả nhấn mạnh "Claude có thể giúp bạn xây Claude của riêng bạn".

Tài liệu chính thức có endpoint cho từng primitive (agent, environment, session với các sub-endpoint để liệt kê/stream event và resource), multi-agent, credential vault (lưu token MCP một lần, tiêm vào mà Claude không thấy) và memory store (Claude đọc/ghi memory qua thời gian để mỗi session tốt hơn lần trước).

Khi chạy thật, diễn giả gửi một outcome event yêu cầu Claude nghiên cứu ba công ty (Bridgewell Dynamics, Norwood Automation, Acme Robotics), tự phê bình và đối chiếu kết quả với rubric. Trong sessions view, có thể thấy Claude đã spawn bốn agent khác — mỗi đường ngang là một agent độc lập có ngữ cảnh riêng, đang web search, trao đổi với coordinator. Console cũng cho theo dõi độ trễ tool, đọc/sửa memory store khi Claude điền sai thông tin.

Vì sao dùng Managed Agents

Nếu tự làm tất cả, bạn sẽ phải xây agent loop riêng (hoặc dùng Agent SDK), tìm cách host từ xa, lo quản lý ngữ cảnh và chuyển trạng thái, tích hợp skill/MCP, xây lớp lưu trữ bền vững, dựng đội sandbox phản ứng theo Claude, và xử lý xác thực end-user một cách an toàn. Với Claude Managed Agents, tất cả những thứ đó có sẵn out-of-the-box.

Góp ý / Báo lỗiPhát hiện sai sót hoặc có ý tưởng cải thiện?