Michael Dell, nhà sáng lập kiêm CEO của Dell, cho rằng trước khi giao công việc cho AI agent, doanh nghiệp cần xác định rõ một điều: dù nhận được chỉ thị nào, agent tuyệt đối không được phép làm gì. Vấn đề trở nên cấp thiết khi các hệ thống AI bắt đầu được kết nối với mạng nội bộ, tệp dữ liệu và môi trường lập trình của doanh nghiệp, khiến việc thiết lập giới hạn an toàn trở thành điều kiện quan trọng để triển khai công nghệ này.
Michael Dell: Doanh nghiệp cần xác định rõ giới hạn
AI agent khác với chatbot chỉ tạo văn bản hoặc trả lời câu hỏi. Chúng có thể tự viết mã, mở tệp và thực hiện liên tiếp nhiều thao tác trong hệ thống doanh nghiệp mà không cần con người xác nhận ở từng bước.
Michael Dell ví AI agent như một nhân viên. Theo ông, không công ty nào cho phép nhân viên tùy ý mở mọi cánh cửa trong tổ chức mà không có kiểm soát quyền truy cập; agent kỹ thuật số cũng cần chịu những giới hạn tương tự. Trước khi triển khai, doanh nghiệp cần xác định agent được phép tiếp cận dữ liệu nào, có thể truy cập những hệ thống nào và được thực hiện các thao tác gì.
Ông cũng lưu ý rằng chỉ dựa vào câu lệnh đầu vào hoặc bản thân mô hình thì chưa đủ để tạo thành hàng rào an toàn. Các giới hạn quan trọng cần được thực thi ở cấp hệ thống và phần cứng, thay vì chỉ ghi trong lời nhắc dành cho mô hình.
Nvidia kết hợp kiểm soát bằng phần mềm và phần cứng
Nvidia gần đây giới thiệu Open Agent Safety Platform, một lớp kiểm soát an toàn dành cho AI agent. CEO Nvidia Jensen Huang mô tả đây là một hệ sinh thái mở để các bên xây dựng hạ tầng vận hành agent an toàn. Nền tảng hiện có hơn 100 đối tác, trong đó có Anthropic, Microsoft và CrowdStrike.
Nền tảng gồm hai phần. OpenShell là bộ công cụ phần mềm quy định agent có thể nhìn thấy thông tin nào và được phép thực hiện thao tác gì. Sentry chạy trên một chip riêng, giám sát hành vi của agent từ bên ngoài máy tính chủ. Michael Dell cho biết nếu agent vi phạm quy tắc đã đặt ra, hệ thống có thể cô lập hoặc hạn chế nó trong vòng vài mili giây.
Nvidia cho biết OpenShell được phát triển theo hướng mã nguồn mở và không giới hạn ở phần cứng của hãng; phần mềm cũng có thể chạy trên chip Arm và Intel. Công cụ này đã được đăng tải trên GitHub. Tuy nhiên, mỗi doanh nghiệp vẫn phải tự xác định cụ thể những việc agent bị cấm làm; nền tảng không soạn sẵn toàn bộ quy tắc thay cho đơn vị triển khai.
AI agent đã tiếp cận các hệ thống thực tế
Những lo ngại về giới hạn an toàn không chỉ xuất hiện trong môi trường thử nghiệm. Bốn phòng thí nghiệm AI tiên phong đã xác nhận mô hình của họ từng tiếp xúc với hệ thống thực tế của doanh nghiệp hoặc tổ chức.
Google từng thừa nhận Gemini đã xâm nhập được vào ba công ty trong một thử nghiệm hồi tháng 5. Tuần trước, một agent của OpenAI đã xâm nhập cổng Medicare của chính phủ Australia. Các sự việc cho thấy khi được cấp quyền truy cập mạng, tệp dữ liệu hoặc hệ thống nghiệp vụ, AI agent có thể hành động vượt ngoài dự tính ban đầu của doanh nghiệp. Vì vậy, mối liên hệ giữa năng lực của mô hình và phạm vi quyền truy cập trở thành trọng tâm của việc kiểm soát an toàn.
Jensen Huang trước đây cũng nói rằng các phòng thí nghiệm nên dừng hoạt động nếu không thể kiểm soát hiệu quả các thử nghiệm AI. Khi đề cập đến Open Agent Safety Platform, ông nói: “Tiềm năng to lớn của AI đối với xã hội chỉ có thể thành hiện thực khi chúng ta giải quyết được vấn đề an toàn AI.”
Với doanh nghiệp và nhà đầu tư, câu hỏi còn bỏ ngỏ là mỗi công ty sẽ xác định những hành động bị cấm như thế nào, và liệu các giới hạn đó có tiếp tục được thực thi khi câu lệnh bị bỏ qua, mô hình hành xử bất thường hoặc quyền truy cập bị lạm dụng hay không. Nền tảng của Nvidia cung cấp công cụ kiểm soát bằng phần mềm và phần cứng, nhưng quy tắc cấp quyền và ranh giới trách nhiệm cuối cùng vẫn do đơn vị triển khai quyết định.