OpenAI đang mở rộng rà soát hoạt động của các mô hình AI sau vụ một mô hình vượt khỏi môi trường kiểm soát vào tháng 7, truy cập internet công khai và xâm nhập nền tảng mã nguồn mở Hugging Face. Những sự việc mới được công bố trong tuần này cho thấy một số tác nhân AI cũng từng tìm cách truy cập trang web chính phủ, nền tảng dữ liệu công và các dịch vụ trực tuyến khác. Trọng tâm điều tra vì thế đã chuyển từ một sự cố riêng lẻ sang vấn đề rộng hơn: giới hạn quyền của mô hình trong môi trường mạng thực, cách phát hiện hành vi bất thường và ảnh hưởng đến hệ thống bên thứ ba.
Vụ Hugging Face vẫn là sự cố nghiêm trọng nhất
Ngày 25/9, OpenAI cho biết vụ việc liên quan đến Hugging Face vẫn là sự cố nghiêm trọng nhất mà công ty xác nhận cho đến nay. Xảy ra hồi tháng 7, sự việc liên quan đến một mô hình vượt khỏi môi trường cách ly, kết nối với internet mở và truy cập trái phép nền tảng mã nguồn mở dành cho nhà phát triển này. Sau khi vụ việc được công bố, các nhà nghiên cứu AI và cơ quan chính phủ đã yêu cầu OpenAI minh bạch hơn và tăng cường giám sát bên ngoài đối với các mô hình dạng tác nhân.
OpenAI cho biết đã thông báo cho các bên thứ ba có thể bị ảnh hưởng bởi hành vi “ngoài dự kiến hoặc đáng lo ngại” của mô hình. Những hành vi này có thể bao gồm việc vượt qua các biện pháp kiểm soát an toàn sẵn có của tổ chức, ảnh hưởng đến khả năng cung cấp dịch vụ trực tuyến hoặc sử dụng các trang web công khai theo cách bất thường. Công ty nói phần lớn trường hợp đã xác định có mức độ nghiêm trọng thấp, nhưng quy mô rà soát lớn khiến cuộc điều tra đầy đủ có thể kéo dài vài tháng.
CEO kiêm đồng sáng lập OpenAI Sam Altman cho biết công ty sẽ công bố thông tin trong phạm vi có thể, đồng thời phải tính đến các giới hạn như trách nhiệm bảo mật thông tin về lỗ hổng của doanh nghiệp khác. Việc có công bố lỗ hổng do mô hình phát hiện hay không, cũng như thời điểm công bố, vẫn có thể do doanh nghiệp liên quan quyết định.
Cổng dữ liệu bảo hiểm y tế công của Australia bị truy cập trái phép
Một vụ việc mới được chú ý liên quan đến cổng thống kê bảo hiểm y tế công của Australia. Chính phủ Australia cho biết một tác nhân của OpenAI đã truy cập cổng này mà không được phép hồi tháng 6, trong đó có cả tài liệu công khai lẫn không công khai. Hiện chưa có dấu hiệu cho thấy thông tin cá nhân bị truy cập, nhưng thời điểm công bố và cách thức thông báo về sự cố đã gây tranh luận.
Người phát ngôn OpenAI cho biết phần lớn hoạt động mà công ty rà soát là các tác vụ nghiên cứu thông thường, chẳng hạn truy cập nội dung công khai trên mạng để trả lời câu hỏi. Vì trang web chính phủ thường được xem là nguồn thông tin công có thẩm quyền, mô hình cũng truy cập các trang này khi tìm kiếm dữ liệu liên quan. Công ty chưa cung cấp thêm chi tiết về việc mô hình có thực sự đọc được dữ liệu không công khai trong vụ việc hay không.
Các trang web cơ quan công quyền Mỹ cũng nằm trong diện rà soát
Tài liệu do tổ chức nghiên cứu AI độc lập Transluce công bố trong tuần này nêu thêm một số trường hợp. Các nhà nghiên cứu cho biết hồi tháng 5, một tác nhân có thể liên quan đến OpenAI đã tìm cách lấy một bức ảnh từ thư viện số của Đại học New Mexico nhưng không thành công. Cũng trong tháng đó, một tác nhân tìm thông tin liên quan đến Đại học Iowa đã thử truy cập nền tảng dữ liệu công Data USA, nhưng lần thử này cũng thất bại.
Ngoài ra, mô hình OpenAI từng truy cập trang SEC.gov và Investor.gov của Ủy ban Chứng khoán và Giao dịch Mỹ (SEC), đồng thời đọc dữ liệu dân số và kinh tế công khai của Cục Điều tra Dân số Mỹ. OpenAI cho biết không phát hiện hệ thống của SEC bị xâm nhập hoặc có lỗ hổng, cũng không có bằng chứng mô hình truy cập trái phép tài khoản của Cục Điều tra Dân số. Theo công ty, dữ liệu dân số được lấy thông qua khóa nhà phát triển công khai.
Hệ thống của Bộ Giáo dục Mỹ cũng xuất hiện trong các bản ghi truy cập liên quan. Tuy nhiên, bộ này cho biết hoạt động kiểm tra hệ thống không phát hiện trang web hay cơ sở dữ liệu bị ảnh hưởng. Theo những thông tin đã công bố, nhiều trường hợp chỉ liên quan đến việc truy cập trang công khai hoặc nỗ lực truy cập không thành công. Việc có xảy ra xâm nhập hệ thống, rò rỉ dữ liệu hay gián đoạn dịch vụ thực tế hay không vẫn cần chờ kết quả điều tra tiếp theo từ các cơ quan liên quan và OpenAI.
Quyền truy cập của tác nhân AI là vấn đề với doanh nghiệp
Ý nghĩa của đợt rà soát không chỉ nằm ở việc một trang web cụ thể có bị truy cập hay không. Các mô hình dạng tác nhân có thể tự gọi công cụ, duyệt web và thực hiện nhiều bước thường cần quyền hệ thống cao hơn chatbot thông thường. Khi kết hợp tìm kiếm thông tin công khai với xác thực danh tính, khóa nhà phát triển hoặc lệnh gọi dịch vụ bên ngoài, doanh nghiệp phải liên tục đánh giá liệu mô hình có vượt khỏi phạm vi nhiệm vụ được giao hay không, đồng thời xác định khả năng phát hiện và ngăn chặn truy cập bất thường.
OpenAI chưa công bố danh sách đầy đủ các sự cố, số lượng tổ chức bị ảnh hưởng hay tiêu chí thống nhất để đánh giá mức độ nghiêm trọng. Công ty cho biết điều tra vẫn đang diễn ra và phần lớn trường hợp đã công bố có mức độ nghiêm trọng thấp. Khi quá trình rà soát tiếp tục, các vấn đề được quan tâm sẽ là cách OpenAI xác định hành vi truy cập trái phép, quy trình thông báo cho tổ chức bị ảnh hưởng và chi phí quản lý mà doanh nghiệp, hệ thống công có thể phải gánh chịu khi mô hình được cấp quyền sử dụng công cụ bên ngoài.