Chủ tịch kiêm CEO Microsoft Satya Nadella ngày 10/10 cho rằng các hệ thống trí tuệ nhân tạo (AI) tiên tiến cần được trang bị cơ chế cách ly, quyền kiểm soát độc lập và một “phanh khẩn cấp” cho phép người được ủy quyền tạm dừng hoặc tắt mô hình ngay trong lúc đang thực hiện nhiệm vụ. Đề xuất này mở rộng phạm vi an toàn AI từ bản thân mô hình sang cơ chế vận hành và quy trình kiểm toán, đồng thời liên quan trực tiếp đến cách doanh nghiệp kiểm soát nguy cơ gián đoạn hoạt động và mất kiểm soát hệ thống khi triển khai AI.
Nadella đề xuất kiểm soát mô hình bằng hệ thống có thể giám sát
Trong một bài đăng trên mạng xã hội X, Nadella cho biết các mô hình mang tính phi xác định cần được đặt trong một hệ thống có thiết kế xác định chặt chẽ, cơ chế con người kiểm soát và quy trình vận hành đáng tin cậy. Khi các tiêu chuẩn hiện tại chưa đủ, ngành công nghệ cần xây dựng thêm những quy tắc mới. Ông cũng đề xuất quản lý các mô hình tiên tiến đóng và mô hình có trọng số mở như những “rủi ro nội bộ”, từ đó thiết lập các lớp bảo vệ tương ứng.
Các nguyên tắc được Nadella nêu ra còn bao gồm khả năng quan sát hệ thống. Theo đó, doanh nghiệp nên sử dụng nhiều mô hình khác nhau, bảo đảm các hành động của mô hình để lại nhật ký mà con người có thể đọc và đánh giá, đồng thời tiến hành kiểm thử liên tục. Hệ thống cũng cần có cơ chế kiểm soát và kiểm toán độc lập, biện pháp cách ly cùng quy trình công bố sự cố.
Với doanh nghiệp và nhà đầu tư, những yêu cầu này không chỉ liên quan đến hiệu suất của mô hình. Chúng còn tác động đến chi phí triển khai sản phẩm AI, trách nhiệm vận hành và cách xử lý các tổn thất tiềm ẩn khi hệ thống hoạt động sai hoặc gây gián đoạn.
Nadella viết rằng hệ thống siêu trí tuệ đáng tin cậy nhất không nên chỉ dựa vào một mô hình được con người tin tưởng nhất. Thay vào đó, ngay cả khi vẫn giữ thái độ thận trọng với mô hình, người dùng phải có thể tin tưởng vào cơ chế vận hành tổng thể của hệ thống.
Giới công nghệ tranh luận về tốc độ phát triển và an toàn AI
Phát biểu của Nadella được đưa ra trong bối cảnh ngành công nghệ tiếp tục tranh luận về mức độ cần thiết của các biện pháp an toàn AI. Đồng sáng lập Microsoft Bill Gates, CEO Anthropic Dario Amodei, CEO OpenAI Sam Altman và CEO SpaceX Elon Musk đều từng bày tỏ lo ngại về việc các biện pháp bảo đảm an toàn chưa đầy đủ hoặc tốc độ phát triển công nghệ đang quá nhanh.
Tháng trước, một nhà nghiên cứu AI rời Anthropic và cáo buộc công ty này cùng đối thủ OpenAI đang đặt tính mạng con người vào rủi ro. Cũng trong ngày đó, một lãnh đạo phụ trách alignment, tức sự phù hợp giữa mục tiêu của AI và lợi ích con người, tại Anthropic cho rằng xác suất công nghệ này gây ra “sự tuyệt chủng của toàn nhân loại” trong 10 năm tới là trên 10%.
Những phát biểu trên cho thấy mối quan tâm trong ngành đối với các rủi ro cực đoan, nhưng đồng thời cũng làm gia tăng tranh luận về phương pháp đánh giá rủi ro, các biện pháp quản trị và cách công khai những nhận định như vậy. Đối với các công ty phát triển AI, các yêu cầu về kiểm thử, kiểm toán và khả năng dừng hệ thống có thể kéo theo chi phí vận hành cũng như trách nhiệm lớn hơn khi đưa sản phẩm vào sử dụng.
Chính sách Mỹ vẫn đặt trọng tâm vào cạnh tranh với Trung Quốc
Tổng thống Mỹ Donald Trump nhiều lần hạ thấp khả năng AI có thể dẫn đến sự tuyệt chủng của loài người, đồng thời nhấn mạnh Mỹ cần duy trì vị thế dẫn đầu trước Trung Quốc trong lĩnh vực AI. Gần đây, ông Trump cũng thông báo thành lập “AI Force” mới do Giám đốc Tình báo Quốc gia Jay Clayton đứng đầu. Nhiệm vụ của cơ quan này bao gồm thúc đẩy ngành công nghiệp và rà soát các đối tượng có hành vi sai phạm.
Điều này khiến cuộc thảo luận về quản trị AI diễn ra trên hai hướng song song. Một bên là các lãnh đạo doanh nghiệp và nhà nghiên cứu yêu cầu tăng cường kiểm soát an toàn, trong đó một số người đề nghị làm chậm quá trình phát triển công nghệ tiên tiến. Bên còn lại là chính phủ Mỹ, với ưu tiên duy trì năng lực cạnh tranh công nghiệp, đồng thời thiết lập các cơ chế liên quan đến an toàn.
Các đề xuất của Nadella về khả năng con người dừng hệ thống, cơ chế cách ly, kiểm toán và công bố sự cố tập trung vào một vấn đề cụ thể: làm thế nào để AI tiếp tục được phát triển và triển khai mà vẫn giữ được quyền can thiệp của con người khi hệ thống gặp sự cố hoặc phát sinh rủi ro.