Vấn đề lớn nhất của AI Agent không phải là có làm được việc hay không, mà là có dám để nó làm hay không
Trong năm qua, những câu chuyện về AI Agent "mất kiểm soát" không hiếm: gửi email không đáng gửi, xóa tệp không đáng xóa, biến một tác vụ nhỏ thành một loạt hậu quả phụ.
Đây không phải là do mô hình không đủ thông minh, mà là môi trường thực thi không có ranh giới bảo mật.
Bản cập nhật Agents SDK của OpenAI vào ngày 15 tháng 4 giải quyết chính vấn đề này: giới thiệu cơ chế sandbox, cho phép Agent chạy trong một môi trường tính toán cách ly, không thể tiếp xúc với các tệp và công cụ mà nó không nên chạm vào.
Sandbox hoạt động như thế nào
Nói đơn giản: Agent bị giới hạn trong một "khu vực làm việc", chỉ có thể truy cập các tệp và đường dẫn mã được cho phép rõ ràng, không thể thao tác các phần khác của hệ thống máy chủ.
SDK hiện hỗ trợ nhiều nhà cung cấp dịch vụ sandbox bên thứ ba, doanh nghiệp có thể mang cơ sở hạ tầng của riêng mình hoặc kết nối trực tiếp với các nền tảng sau:
| Nhà cung cấp Sandbox | Đặc điểm |
|---|---|
| Cloudflare | Tính toán biên, độ trễ thấp |
| Vercel | Thân thiện với frontend, sandbox hàm |
| E2B | Tập trung vào thực thi mã AI |
| Modal | Sức mạnh tính toán linh hoạt |
| Daytona | Cách ly môi trường phát triển |
| Runloop | Quy trình làm việc cấp doanh nghiệp |
| Blaxel | Dành riêng cho AI Agent |
Việc chọn nhà cung cấp nào phụ thuộc vào công nghệ hiện tại của bạn, hầu hết các đội nhóm sẽ tìm được giải pháp phù hợp.
Còn gì mới nữa không
Ngoài sandbox, bản cập nhật này còn mang đến:
- Model native Harness: Hỗ trợ Agent thực hiện các tác vụ chuỗi dài qua nhiều bước giữa tệp, mã và công cụ, không chỉ là tương tác đơn lẻ
- Hỗ trợ Agent con (lộ trình): Trong tương lai, Agent có thể được chia thành nhiều tác vụ con để thực thi đồng thời
- Chế độ mã (lộ trình): Chế độ hành vi Agent đặc biệt phù hợp hơn cho thực thi mã
Karan Sharma từ nhóm sản phẩm OpenAI cho biết họ muốn các nhà phát triển "sử dụng harness của chúng tôi và cơ sở hạ tầng của riêng họ để xây dựng các Agent có tầm nhìn xa".
Có hạn chế gì không
Hiện tại chỉ có phiên bản Python, hỗ trợ TypeScript đang trên lộ trình nhưng chưa có thời gian cụ thể.
Điều này gây bất tiện cho các đội nhóm do frontend dẫn dắt, nhưng không thành vấn đề lớn với backend và kỹ thuật dữ liệu.
Về giá cả, tính theo API tiêu chuẩn, không thu thêm phí.
Tại sao điều này đáng chú ý
Trên đường đua Agent, Anthropic có Managed Agents, Microsoft có khung AutoGen, SDK trước đây của OpenAI tương đối thô sơ.
Sau bản cập nhật này, cơ sở hạ tầng Agent của OpenAI cuối cùng đã có khả năng bảo mật cấp doanh nghiệp cơ bản — cơ chế sandbox là điều kiện cần cho triển khai sản xuất, nếu không có nó, doanh nghiệp không dám đặt Agent vào các quy trình quan trọng.
Thời điểm cũng khá thú vị: cùng lúc Anthropic đưa Claude Managed Agent đến doanh nghiệp, động thái này của OpenAI giống như một bản cập nhật phòng thủ hơn là tấn công. Nhưng đối với các nhà phát triển, cả hai bên đều đang nghiêm túc xây dựng cơ sở hạ tầng Agent, dù sao cũng là điều tốt.
Nguồn tham khảo: OpenAI updates its Agents SDK to help enterprises build safer,CocoLoop、 more capable agents(TechCrunch)