OpenAI thêm sandbox vào Agent SDK

Vấn đề lớn nhất của AI Agent không phải là có làm được việc hay không, mà là có dám để nó làm hay không

Trong năm qua, những câu chuyện về AI Agent "mất kiểm soát" không hiếm: gửi email không đáng gửi, xóa tệp không đáng xóa, biến một tác vụ nhỏ thành một loạt hậu quả phụ.

Đây không phải là do mô hình không đủ thông minh, mà là môi trường thực thi không có ranh giới bảo mật.

Bản cập nhật Agents SDK của OpenAI vào ngày 15 tháng 4 giải quyết chính vấn đề này: giới thiệu cơ chế sandbox, cho phép Agent chạy trong một môi trường tính toán cách ly, không thể tiếp xúc với các tệp và công cụ mà nó không nên chạm vào.

Sandbox hoạt động như thế nào

Nói đơn giản: Agent bị giới hạn trong một "khu vực làm việc", chỉ có thể truy cập các tệp và đường dẫn mã được cho phép rõ ràng, không thể thao tác các phần khác của hệ thống máy chủ.

SDK hiện hỗ trợ nhiều nhà cung cấp dịch vụ sandbox bên thứ ba, doanh nghiệp có thể mang cơ sở hạ tầng của riêng mình hoặc kết nối trực tiếp với các nền tảng sau:

Nhà cung cấp Sandbox Đặc điểm
Cloudflare Tính toán biên, độ trễ thấp
Vercel Thân thiện với frontend, sandbox hàm
E2B Tập trung vào thực thi mã AI
Modal Sức mạnh tính toán linh hoạt
Daytona Cách ly môi trường phát triển
Runloop Quy trình làm việc cấp doanh nghiệp
Blaxel Dành riêng cho AI Agent

Việc chọn nhà cung cấp nào phụ thuộc vào công nghệ hiện tại của bạn, hầu hết các đội nhóm sẽ tìm được giải pháp phù hợp.

Còn gì mới nữa không

Ngoài sandbox, bản cập nhật này còn mang đến:

  • Model native Harness: Hỗ trợ Agent thực hiện các tác vụ chuỗi dài qua nhiều bước giữa tệp, mã và công cụ, không chỉ là tương tác đơn lẻ
  • Hỗ trợ Agent con (lộ trình): Trong tương lai, Agent có thể được chia thành nhiều tác vụ con để thực thi đồng thời
  • Chế độ mã (lộ trình): Chế độ hành vi Agent đặc biệt phù hợp hơn cho thực thi mã

Karan Sharma từ nhóm sản phẩm OpenAI cho biết họ muốn các nhà phát triển "sử dụng harness của chúng tôi và cơ sở hạ tầng của riêng họ để xây dựng các Agent có tầm nhìn xa".

Có hạn chế gì không

Hiện tại chỉ có phiên bản Python, hỗ trợ TypeScript đang trên lộ trình nhưng chưa có thời gian cụ thể.

Điều này gây bất tiện cho các đội nhóm do frontend dẫn dắt, nhưng không thành vấn đề lớn với backend và kỹ thuật dữ liệu.

Về giá cả, tính theo API tiêu chuẩn, không thu thêm phí.

Tại sao điều này đáng chú ý

Trên đường đua Agent, Anthropic có Managed Agents, Microsoft có khung AutoGen, SDK trước đây của OpenAI tương đối thô sơ.

Sau bản cập nhật này, cơ sở hạ tầng Agent của OpenAI cuối cùng đã có khả năng bảo mật cấp doanh nghiệp cơ bản — cơ chế sandbox là điều kiện cần cho triển khai sản xuất, nếu không có nó, doanh nghiệp không dám đặt Agent vào các quy trình quan trọng.

Thời điểm cũng khá thú vị: cùng lúc Anthropic đưa Claude Managed Agent đến doanh nghiệp, động thái này của OpenAI giống như một bản cập nhật phòng thủ hơn là tấn công. Nhưng đối với các nhà phát triển, cả hai bên đều đang nghiêm túc xây dựng cơ sở hạ tầng Agent, dù sao cũng là điều tốt.

Nguồn tham khảo: OpenAI updates its Agents SDK to help enterprises build safer,CocoLoop、 more capable agents(TechCrunch)