Nvidia (NVDA) đã ra mắt Nền tảng An toàn cho Tác nhân Mở vào thứ Hai nhằm kiềm chế các tác nhân tự động với mức giám sát của con người tối thiểu, những tác nhân có thể thực thi mã, chuyển tiền hoặc chạm vào các hệ thống nhạy cảm.
Những điểm rút ra
Nvidia đã ra mắt Nền tảng An toàn cho Tác nhân Mở (Open Agent Safety Platform) vào thứ Hai dành cho các tác nhân tự động thực thi mã, chuyển tiền hoặc truy cập các hệ thống nhạy cảm
Nền tảng này kết hợp OpenShell, một môi trường runtime được cách ly (sandbox), với Sentry, một lớp giám sát
OpenShell cô lập việc thực thi của từng tác nhân để một sự xâm phạm không thể lan sang bộ lưu trữ, các container hoặc toàn bộ mạng lưới
Vision One của TrendAI hiện đã bao phủ các tác nhân, mô hình, container, bộ lưu trữ và mạng dưới một bảng điều khiển
Nvidia đã mô tả nền tảng này như một môi trường chạy cô lập (sandboxed runtime) là OpenShell, kết hợp với Sentry, một lớp giám sát.
Bài viết mô tả OpenShell là một môi trường zero-trust, nơi mặc định không cho phép bất cứ điều gì, đáp lại lời cảnh báo kéo dài hàng tháng của các nhà nghiên cứu rằng các tác nhân thường được cấp nhiều quyền hơn mức mà nhiệm vụ yêu cầu.
Tác nhân AI là một chương trình dùng mô hình ngôn ngữ có khả năng thực hiện các hành động nhiều bước, duyệt web, viết và chạy mã, hoặc gọi phần mềm khác—thay vì chỉ trả lời một lời nhắc trò chuyện.
Sự tự chủ đó có thể giúp quản lý đội xe hoặc lập trình, nhưng cũng khiến một tác nhân bị xâm phạm hoặc bị chỉ dẫn sai trở nên nguy hiểm. OpenShell cô lập việc thực thi của từng tác nhân, để một lỗ hổng trong một sandbox không thể lan sang kho lưu trữ, các container hoặc mạng lưới rộng hơn mà nó chạm tới.
Đọc thêm: Các quan chức an toàn AI của Trung Quốc bác bỏ cách đóng khung rủi ro sinh tồn của Mỹ
Hãng cung cấp bảo mật TrendAI cho biết hôm thứ Hai họ đang mở rộng nền tảng của Nvidia bằng cách thêm lớp tình báo mối đe dọa của riêng mình; quan hệ hợp tác này được Nvidia nêu trong thông báo của mình.
Vision One của TrendAI hiện đã bao phủ các tác nhân, mô hình, container, bộ lưu trữ và mạng dưới một bảng điều khiển, mở rộng phạm vi vốn trước đó chỉ dừng ở lớp mô hình.
Vì sao bảo mật tác nhân trở thành vấn đề mà Nvidia cần giải quyết
Nvidia đã dành thời gian trong năm 2026 để định vị mình như lớp hạ tầng nằm dưới mọi trung tâm tính toán của các phòng thí nghiệm AI lớn. Trung tâm dữ liệu của họ ngày càng lưu trữ các tác nhân do OpenAI, Anthropic và khách hàng doanh nghiệp xây dựng, thực thi giao dịch tài chính và quản lý hạ tầng mà không cần con người phê duyệt từng bước.
Các sự cố an ninh liên quan đến tác nhân đã dồn lại trong quý này, bao gồm một tác nhân của OpenAI đã xâm nhập cổng thông tin y tế tại Australia mà không được ủy quyền.
Nvidia định hình toàn bộ pipeline của tác nhân, “nhà máy AI”, như một đơn vị cần được bảo vệ, chứ không chỉ là mô hình.
Khoảng cách giữa an toàn mô hình và an toàn của nền tảng tác nhân
Phần lớn chi tiêu cho an toàn AI tập trung vào việc lọc đầu ra của chatbot. Tác nhân mang một loại rủi ro khác vì chúng hoạt động trong thế giới thực, và một hành động được cấp phép không phải lúc nào cũng có thể được thu hồi.
Nvidia cho biết Sentry giám sát hành vi theo thời gian thực và có thể dừng một tác nhân giữa nhiệm vụ nếu nó lệch khỏi chính sách được chỉ định, qua đó phân biệt với các công cụ phản ứng chỉ phát hiện vấn đề sau khi thiệt hại đã xảy ra.
Đối với các nhà xây dựng độc lập, những câu hỏi thực tiễn vẫn là các điều khoản của nền tảng, quyền truy cập và chi phí hiệu năng. Doanh nghiệp phải quyết định có tự nguyện áp dụng khóa ở cấp phần cứng hay không.
Đọc tiếp: Thanh toán cho tác nhân AI ra mắt trên Cardano với hỗ trợ X402