Bỏ qua đến nội dung chính

How to get to production faster with Claude Managed Agents

TL;DR

  • Michael và Harrison (member of technical staff tại Anthropic) giới thiệu Claude Managed Agents, một nền tảng giải quyết phần phức tạp về hạ tầng (quản lý ngữ cảnh/bộ nhớ, độ tin cậy, bảo mật, độ trễ, khả năng quan sát) — vốn đã trở thành nút thắt thực sự khi đưa agent vào production.
  • Nền tảng cung cấp các primitive có thể kết hợp: định nghĩa một agent (system prompt, model, skills, tools, permissions), cấp cho nó môi trường sandbox, khởi chạy một session, và quan sát mọi thứ qua event stream gồm user, agent, session và span events.
  • Các tính năng mới được công bố gồm multi-agent orchestration, outcomes, memory, dreaming, self-hosted sandboxes (cùng Cloudflare, Daytona, Modal, Vercel) và MCP tunnels — kèm một phiên thảo luận với các đối tác hạ tầng này.

Điểm chính

  • Trí thông minh của model không còn là rào cản chính; nút thắt để agent "lướt trên đường cong hàm mũ" giờ là hạ tầng — độ tin cậy, khả năng mở rộng, bảo mật, độ trễ và khả năng quan sát quanh model.
  • Để làm được nhiều hơn, agent cần truy cập nhiều hơn: thông tin xác thực bảo mật, hệ thống nội bộ, GitHub repo riêng tư, và một identity/auth để dùng công cụ như một nhân viên thật.
  • Cách tương tác đang dịch chuyển từ hội thoại text-vào/text-ra sang hoạt động hướng kết quả (outcome-oriented): bạn giao một nhiệm vụ và agent tự làm, thậm chí có thể tạm dừng rồi tiếp tục sau hàng tuần/tháng.
  • Bốn bước bắt đầu: định nghĩa agent, cấp môi trường sandbox (network allow list, package cài sẵn), khởi chạy session, và lắng nghe event stream để quan sát.
  • Event stream được chia thành user events, agent events, session events và span events, tất cả lộ ra qua API, giúp lập trình viên hiểu chính xác điều gì đang xảy ra, vì sao và khi nào.
  • Tính năng nâng cao gồm multi-agent orchestration (sinh thêm các luồng agent có context window riêng), outcomes (rubric để Claude lặp tới khi đạt), memory (kho lưu trữ dài hạn) và dreaming (suy ngẫm qua hàng nghìn session để tinh chỉnh bộ nhớ).
  • Hai tính năng mới: self-hosted sandboxes cho phép mang hạ tầng/VPC của riêng bạn (qua Cloudflare, Daytona, Modal, Vercel), và MCP tunnels lộ MCP server riêng tư cho Claude mà không phơi bày gì ra internet công cộng.
  • Các diễn giả nêu khái niệm "human emulator" — cấp cho agent một sandbox thì nó làm được gần như mọi tác vụ knowledge-work số — đồng thời chỉ ra các vấn đề mở về truyền identity, lọc egress và khả năng tiếp tục (resume) task đã tạm dừng.

Từ vựng

  • Claude Managed Agents — nền tảng quản lý hạ tầng và primitive cho agent production của Anthropic
  • primitive — khối xây dựng có thể kết hợp (composable building block)
  • sandbox — môi trường cô lập để agent chạy code
  • event stream — luồng sự kiện của một session
  • outcome — rubric/bộ mục tiêu để Claude lặp tới khi đạt
  • memory — kho lưu trữ dài hạn để Claude tốt dần qua các phiên
  • dreaming — suy ngẫm qua hàng nghìn phiên để tinh chỉnh bộ nhớ
  • self-hosted sandbox — sandbox tự host trên hạ tầng/VPC riêng
  • MCP tunnel — đường hầm để lộ MCP server riêng tư cho Claude

Nội dung chi tiết

Đường cong hàm mũ và sự dịch chuyển của nút thắt

Trong vài năm qua, năng lực AI đã tăng theo cấp số nhân. Từ dòng Claude 3 — nơi mới chỉ làm được những việc đơn giản, ngắn gọn — đến Opus 4 với sự nổi lên của Claude Code cho phép agent tự xử lý cả một tính năng và tạo PR, dù vẫn cần con người lái rất nhiều. Đến Opus 4.7, người dùng "dọn sạch backlog" và thức dậy với hàng loạt PR sẵn sàng merge.

Điểm mấu chốt: với các dòng model mới, nút thắt để tăng năng lực không còn là trí thông minh của model, mà là hạ tầng xung quanh nó. Tương lai được hình dung là khối lượng công việc cả một quý có thể hoàn thành trong vài giờ nhờ một "đàn" (swarm) các nhóm agent.

Vì sao xây dựng Claude Managed Agents

Để làm được nhiều hơn, agent cần truy cập nhiều hơn: thông tin xác thực bảo mật, hệ thống nội bộ, GitHub repo riêng tư, và đặc biệt là identity cùng auth — danh tính xác định agent là ai, giống như một kỹ sư có quyền truy cập Slack, email và các công cụ nội bộ.

Cách tương tác cũng đang thay đổi: từ kiểu hội thoại quen thuộc (gửi text, nhận phản hồi) sang hoạt động hướng kết quả — giao nhiệm vụ và để agent tự làm, chỉ quay lại khi tự tin đã hoàn tất. Nền tảng cũng hỗ trợ khởi động một agent rồi tiếp tục nó sau hàng tuần hoặc hàng tháng.

Nghiên cứu của Anthropic chỉ ra các điểm nghẽn chính: quản lý ngữ cảnh và memory (làm tốt thì rất mạnh, làm sai thì phá hỏng hoàn toàn), các lo ngại hạ tầng (độ tin cậy, khả năng mở rộng, bảo mật, độ trễ — đây là lý do số một ngăn người dùng tận dụng model) và khả năng quan sát (observability) — nếu không biết agent có thành công hay không thì mọi thứ vô nghĩa. Managed Agents làm sẵn toàn bộ phần nền tảng đó để bạn chỉ việc chọn các primitive có thể kết hợp.

Bắt đầu với bốn bước

  1. Định nghĩa agent: một gói cấu hình gồm system prompt, model, skills, tools, permissions và danh tính của thực thể thực hiện hành động.
  2. Cấp môi trường sandbox: nơi agent chạy code, cấu hình được network allow list và các package cài sẵn.
  3. Khởi chạy session: giao một phần công việc và để agent quay lại khi sẵn sàng.
  4. Lắng nghe event stream: quan sát agent đang làm gì, vì sao, và tương tác theo ý muốn.

Event stream được chia thành bốn loại: user events (tin nhắn, hình ảnh, tài liệu, ngắt agent, tool result, xác nhận human-in-the-loop, outcome definition), agent events (Claude trả lời, chạy tool, phối hợp với agent khác), session events (vòng đời session: idle → running, khôi phục lỗi, xử lý outcome) và span events (đánh dấu khi một việc bắt đầu/kết thúc). Tất cả đều lộ ra qua API.

Buổi demo dùng "Pascal", một agent giả định phân tích thói quen mua sắm tạp hóa: dashboard kích hoạt một lượt phân tích, console hiển thị mọi sự kiện real time, định nghĩa agentic và cấu hình networking/container, và nút "Ask Claude" để Claude đọc transcript của session và đề xuất tối ưu (ví dụ một script Python chạy hơn 20 giây cần tối ưu).

Công cụ cho lập trình viên và tính năng nâng cao

Để bắt đầu, có thể dùng ngay skill Claude API đi kèm Claude Code, một CLI để thao tác với agent/session, và bộ cookbook mã sẵn copy-paste.

Các tính năng nâng cao:

  • Multi-agent orchestration: Claude sinh thêm các luồng agent có context window riêng để ủy thác và trao đổi qua lại.
  • Outcomes: định nghĩa rubric/mục tiêu để Claude tự chấm và lặp tới khi hài lòng.
  • Memory: đọc/ghi kho lưu trữ dài hạn để mỗi session tốt hơn lần trước.
  • Dreaming (research preview): suy ngẫm qua hàng nghìn session để tạo và tinh chỉnh bộ nhớ.

Hai tính năng mới công bố: self-hosted sandboxes (mang hạ tầng/VPC riêng, kiểm soát network policy, audit log, vòng đời sandbox; Anthropic chỉ gửi tín hiệu khi cần cấp sandbox mới) và MCP tunnels (lộ MCP server riêng tư cho Claude qua một lớp proxy đơn giản, không phơi bày ra internet công cộng).

Phiên thảo luận với các đối tác hạ tầng

Bốn đối tác sandbox chia sẻ chiến lược: Vercel (Luke) xây mọi thứ trên cùng nền tảng fluid compute để tái sử dụng tính năng giữa build/sandbox/function; Modal (Akshat) có scheduler riêng spin up hàng trăm nghìn sandbox trong vài phút, hỗ trợ GPU và nhiều region cho độ trễ thấp; Daytona (Yvon) với nguyên tắc "agent cần thứ con người cần" — đa dạng cấu hình cùng tốc độ, quy mô và khả năng pause/resume/fork; Cloudflare (Mike) đặt cược vào hai primitive — micro VM và isolates siêu nhẹ khởi động trong mili-giây để mở rộng cực mạnh.

Các diễn giả hào hứng với khái niệm "human emulator": cấp cho agent một sandbox thì nó làm được gần như mọi tác vụ của một knowledge worker số, kể cả cài và đăng nhập ứng dụng legacy trên Windows để tạo báo cáo end-to-end. Họ cũng nêu các bài toán còn mở: truyền identity xuyên suốt chuỗi agent, lọc egress, gán danh tính cho từng agent, khả năng resume task đã tạm dừng, và sự chuyển dịch từ hoạt động "single-player" sang "multiplayer" mà ngành chưa hiểu hết.

Góp ý / Báo lỗiPhát hiện sai sót hoặc có ý tưởng cải thiện?