NVIDIA ngày 28/9/2026 công bố Open Agent Safety Platform, một bộ công cụ nhằm đặt giới hạn kỹ thuật quanh các hệ thống AI có khả năng tự thực hiện nhiều bước công việc. Nền tảng gồm hai phần chính: phần mềm mã nguồn mở OpenShell và thiết kế hệ thống giám sát Sentry chạy tách biệt trên bộ xử lý dữ liệu BlueField-4.

Mục tiêu của cách tiếp cận này là không chỉ yêu cầu mô hình AI “tuân thủ,” mà còn giới hạn từ bên ngoài những tệp, mạng, công cụ và dịch vụ mà một AI agent được phép sử dụng.

Hai lớp kiểm soát

Theo thông báo của NVIDIA, OpenShell tạo một ranh giới chạy an toàn, ghi lại hành động và áp chính sách khi agent hoạt động. NVIDIA cho biết phần mềm được tối ưu cho CPU Vera nhưng vì là mã nguồn mở nên có thể mở rộng sang nền tảng của Arm và Intel.

Sentry đóng vai trò một bộ giám sát “ngoài băng,” tức chạy trên phần cứng tách biệt với tác vụ của agent. Thiết kế dùng BlueField-4 DPU để theo dõi hoạt động, xác minh danh tính, bảo vệ quyền truy cập dữ liệu và áp quy tắc zero-trust. NVIDIA nói Sentry có thể cô lập một agent vượt khỏi ranh giới trong mili-giây.

Điểm đáng chú ý là các con số và tuyên bố hiệu năng hiện chủ yếu đến từ nhà cung cấp. Chúng cần được kiểm chứng trong môi trường triển khai thực tế, với nhiều loại mô hình, công cụ và cấu hình mạng khác nhau.

Công cụ này làm được gì — và không làm được gì?

Một AI agent có thể được giao nhiệm vụ mở tệp, gọi API, truy cập kho mã hay thực hiện thao tác trong hệ thống doanh nghiệp. Nếu quyền được cấp quá rộng hoặc agent diễn giải sai mục tiêu, nó có thể đọc, sửa hoặc gửi dữ liệu ngoài phạm vi cần thiết. OpenShell nhắm đến việc giới hạn bề mặt đó bằng chính sách do tổ chức triển khai đặt ra.

Sentry bổ sung một tầng giám sát độc lập, hữu ích trong trường hợp phần mềm chính bị lỗi hoặc bị qua mặt. Đây là nguyên tắc quen thuộc trong an ninh mạng: không để hệ thống đang được giám sát tự quyết định toàn bộ việc giám sát chính nó.

Tuy vậy, Associated Press dẫn ý kiến chuyên gia rằng nền tảng này không giải quyết mọi vấn đề, chẳng hạn mô hình tạo thông tin sai, hành vi đánh lừa tinh vi hoặc một chính sách được con người cấu hình không đầy đủ. Ranh giới kỹ thuật chỉ hiệu quả nếu quyền hạn được xác định đúng và các cảnh báo được xử lý kịp thời.

Hơn 100 tổ chức tham gia

NVIDIA cho biết hơn 100 tổ chức đang làm việc với các công nghệ trong nền tảng, gồm Anthropic, Microsoft, Cisco, CrowdStrike, Red Hat, Salesforce, SAP và một số công ty hạ tầng, tài chính, robot. Việc có nhiều đối tác có thể giúp tạo chuẩn chung, nhưng cũng không đồng nghĩa từng tổ chức đã triển khai đầy đủ hay xác nhận mọi tuyên bố của NVIDIA.

Reuters Breakingviews lưu ý NVIDIA có lợi ích kinh doanh rõ ràng: niềm tin vào AI agent có thể thúc đẩy nhu cầu hạ tầng tính toán và phần cứng trung tâm dữ liệu. Vì vậy, độc giả nên tách hai câu hỏi: thiết kế có hợp lý về mặt kỹ thuật hay không, và sản phẩm đã chứng minh được mức hiệu quả nào trong thực tế.

Điều doanh nghiệp nên hỏi trước khi triển khai

Trước khi dùng công cụ mới, nhóm an ninh nên xác định agent được phép truy cập dữ liệu nào, trong bao lâu, bằng danh tính nào và ai có quyền nâng cấp đặc quyền. Nhật ký phải đủ chi tiết để điều tra, nhưng không nên tự tạo thêm kho dữ liệu nhạy cảm.

Các tổ chức cũng cần thử tình huống lỗi: agent tìm cách truy cập ngoài phạm vi, hệ thống giám sát mất kết nối, chính sách xung đột hoặc con người phê duyệt sai. Công cụ của NVIDIA có thể là một lớp phòng thủ mới, nhưng không thay thế quản trị quyền truy cập, đánh giá mô hình, giám sát con người và kế hoạch ứng phó sự cố.

Cộng đồng

Bình luận

Người dùngĐang kiểm tra phiên đăng nhập…

Cuộn đến đây để tải thảo luận.