Tranh luận về tốc độ phát triển và cách quản lý trí tuệ nhân tạo (AI) tiên tiến đang mở rộng, với những khác biệt ngày càng rõ giữa các doanh nghiệp lớn. CEO Anthropic Dario Amodei và CEO OpenAI Sam Altman gần đây cùng ủng hộ việc có thể làm chậm tiến độ phát triển các mô hình tiên tiến khi cần, đồng thời đưa vào cơ chế đánh giá độc lập và các tiêu chuẩn an toàn thống nhất hơn. Trong khi đó, CEO Meta Mark Zuckerberg và CEO Nvidia Jensen Huang cho rằng yêu cầu an toàn không nhất thiết mâu thuẫn với tốc độ công nghệ, còn thị trường có thể tạo đủ động lực để doanh nghiệp tự kiểm soát rủi ro mà không cần thêm khung pháp lý mới.
Tranh luận này có ý nghĩa trực tiếp với thị trường bởi cách đánh giá an toàn, phân bổ trách nhiệm và công bố thông tin về các mô hình tiên tiến có thể ảnh hưởng đến tiến độ nghiên cứu, chi phí tuân thủ và định giá doanh nghiệp. Với các công ty vẫn đang chi mạnh cho hạ tầng tính toán và huấn luyện mô hình, câu hỏi ai đặt ra tiêu chuẩn và liệu các tổ chức bên ngoài có được tham gia hay không đã vượt ra ngoài phạm vi kỹ thuật, liên quan cả đến cạnh tranh và điều kiện gia nhập ngành.
Amodei và Altman đề xuất đánh giá độc lập
Amodei cho rằng các công ty phát triển AI tiên tiến nên kiểm soát tốc độ phát triển khi cần thiết, cho phép các đơn vị đánh giá độc lập kiểm tra hệ thống mạnh cũng như quy trình phát triển, đồng thời phối hợp dựa trên các tiêu chuẩn an toàn chung. Altman nhìn chung ủng hộ đề xuất này và cho biết OpenAI cũng sẽ cam kết đưa các đơn vị đánh giá độc lập vào quy trình nội bộ.
Trong một bài viết dài trên mạng xã hội, Zuckerberg phản hồi rằng các công ty AI đã có động lực thương mại đủ lớn để phát triển những hệ thống đáp ứng kỳ vọng của người dùng, tránh các hành vi gây thiệt hại có thể dẫn đến trách nhiệm pháp lý và trì hoãn việc phát hành khi sản phẩm chưa sẵn sàng. Theo ông, người dùng sẽ không tiếp tục sử dụng những tác nhân AI hoạt động trái với kỳ vọng trong thời gian dài. Vì vậy, niềm tin và độ tin cậy của hệ thống có thể trở thành lợi thế cạnh tranh; các phòng thí nghiệm xem nhẹ an toàn có nguy cơ bị bỏ lại trong cuộc đua thị trường, còn doanh nghiệp gây thiệt hại có thể phải đối mặt với trách nhiệm pháp lý đáng kể.
Zuckerberg cũng cho biết Meta từng trì hoãn phát hành tác nhân AI Muse trong vài tháng để tăng cường biện pháp bảo vệ và kiểm thử. Huang cho rằng an toàn và tốc độ không nhất thiết đối lập, đồng thời nhận định ngành AI không cần thêm luật hoặc biện pháp quản lý mới.
Cohere phản đối việc số ít tập đoàn đặt luật chơi
Công ty AI Canada Cohere đưa ra quan điểm khác về hướng quản lý hiện nay. Đồng sáng lập kiêm CEO Aidan Gomez cảnh báo rằng nếu hệ thống an toàn chủ yếu được xây dựng xoay quanh một số ít công ty lớn tại Silicon Valley, đồng thời các công ty này được miễn trừ chống độc quyền để phối hợp xây dựng quy tắc ngành, kết quả có thể trở thành một “cartel dưới tên gọi khác”.
Gomez ủng hộ một khung rủi ro dựa trên bằng chứng, yêu cầu doanh nghiệp tăng tính minh bạch và tiến hành kiểm thử độc lập dựa trên năng lực thực tế của từng hệ thống. Ông cũng đề xuất các cơ chế bảo đảm an toàn không bị chi phối bởi xung đột lợi ích.
Giám đốc AI của Cohere Joelle Pineau cho rằng khi AI hiện diện ngày càng nhiều tại nơi làm việc và trong đời sống hằng ngày, công chúng cần hiểu đặc điểm của các hệ thống này và biết liệu cách sử dụng chúng có đủ an toàn hay không. Theo Pineau, quản lý là một phần của khế ước xã hội: hệ thống không chỉ nhằm giảm thiểu thiệt hại mà còn phải tạo dựng mức độ tin cậy cơ bản.
Tuy nhiên, Pineau nhấn mạnh các công ty phát triển hệ thống tiên tiến không nên là lực lượng duy nhất quyết định quy tắc. Bà lo ngại một số ít phòng thí nghiệm có thể cùng lúc nắm quyền phát triển công nghệ và quyền xây dựng luật chơi. Anthropic và OpenAI có thể tham gia thảo luận chính sách, nhưng quá trình soạn thảo cũng cần có thêm doanh nghiệp, nhà nghiên cứu và các nhóm xã hội khác để phản ánh đầy đủ hơn lợi ích công chúng.
Tranh luận an toàn AI bị đẩy về hai phía
Tranh luận về quản lý AI đã vượt khỏi phạm vi an toàn kỹ thuật truyền thống và ngày càng mang màu sắc đối đầu giữa các nhóm quan điểm. Phong trào Effective Altruism (EA) cũng trở lại tâm điểm tranh cãi. Phong trào này nhấn mạnh việc sử dụng bằng chứng và phân tích định lượng để tìm ra các cách cải thiện phúc lợi xã hội. Một số nhà tài trợ, nhà nghiên cứu và tổ chức liên quan đến EA từ lâu đã tập trung vào những rủi ro cực đoan, thậm chí rủi ro đối với sự tồn tại của nhân loại, do AI có năng lực cao gây ra.
EA từng được chú ý vì mối liên hệ với Sam Bankman-Fried, nhà sáng lập sàn giao dịch tiền mã hóa FTX đã sụp đổ. Gần đây, một số bình luận tiếp tục liên hệ đề xuất đánh giá bên ngoài của Anthropic với phong trào này. Amodei đề xuất các đánh giá viên bên ngoài thuộc tổ chức phi lợi nhuận Model Evaluation and Threat Research (METR) kiểm tra hệ thống AI tiên tiến và quy trình phát triển. Đề xuất này làm dấy lên tranh luận về nền tảng, tính độc lập và phạm vi quyền hạn của tổ chức đánh giá.
Một số cơ quan thuộc chính phủ Mỹ cũng sử dụng khẩu hiệu “chủ nghĩa Mỹ, không phải chủ nghĩa vị tha hiệu quả” trên mạng xã hội, nhấn mạnh yêu cầu duy trì vị thế dẫn đầu của Mỹ trong lĩnh vực AI. Những người ủng hộ quản lý cho rằng kiểm thử an toàn và giám sát độc lập cần được thể chế hóa. Ngược lại, bên phản đối lo ngại các quy tắc mới có thể giúp một số ít công ty hàng đầu gia tăng ảnh hưởng đối với toàn ngành. Sự đối lập này khiến việc hình thành một phương án quản lý thống nhất trở nên khó khăn hơn.
OpenAI công bố sáu sự cố mất kiểm soát
OpenAI công bố thêm sáu sự cố được phát hiện trong quá trình kiểm thử. Công ty cho biết các mô hình từng tìm cách vượt qua biện pháp kiểm soát, trong đó có việc che giấu lỗi, cố gắng lấy thông tin xác thực trái phép, tải tài liệu lên các trang web công khai và liên lạc giữa những môi trường huấn luyện vốn phải được cách ly.
OpenAI cho biết sẽ tăng mức độ minh bạch đối với các sự cố tương tự. Những sự cố đơn giản hơn sẽ được công bố trong vòng sáu ngày làm việc, còn các trường hợp phức tạp dự kiến được công bố trong vòng 12 ngày làm việc. Công ty muốn cơ chế công bố tự nguyện này trở thành thông lệ chung của ngành.
Các thông tin trên được đưa ra sau một sự cố an toàn gần đây của OpenAI. Khi đó, một hệ thống đang trong giai đoạn đánh giá đã vượt qua các biện pháp kiểm soát được thiết lập trước và ảnh hưởng đến một phần hạ tầng của Hugging Face. Sau đó, các nhà nghiên cứu độc lập tiếp tục phát hiện những sự cố khác. Với các doanh nghiệp liên tục nâng cao năng lực mô hình, việc kiểm soát thất bại trong giai đoạn thử nghiệm có thể ảnh hưởng đến đánh giá của khách hàng bên ngoài về giới hạn triển khai, an toàn dữ liệu và trách nhiệm khi xảy ra sự cố.
Ứng dụng lừa đảo bằng AI và kế hoạch niêm yết của Anthropic
Anthropic phát hiện một mạng lưới gồm khoảng 28 ứng dụng hẹn hò giả. Mạng lưới này sử dụng hồ sơ nhân vật do AI tạo ra để trò chuyện liên tục với người dùng, sau đó dụ họ mua tiền ảo trong ứng dụng. Để tài khoản có vẻ chân thực hơn, nền tảng còn bố trí nhân sự được trả tiền thực hiện cuộc gọi video hoặc tương tác trên mạng xã hội khi cần.
Các nhà điều tra nhận thấy phần lớn cuộc trò chuyện trong mạng lưới được tự động hóa, trong khi chỉ khoảng một phần tư đối tượng ghép đôi trên bề mặt là người thật. Anthropic trước đó nhận thấy một tài khoản Claude gửi hơn 100.000 yêu cầu API mỗi ngày, rồi lần theo mô hình vận hành liên quan. Vụ việc cho thấy AI tạo sinh không chỉ làm giảm chi phí vận hành tài khoản giả ở quy mô lớn mà còn khiến người dùng khó phân biệt tương tác thật với các bẫy thanh toán hơn.
Trong lúc đó, Anthropic vẫn dự kiến xúc tiến kế hoạch niêm yết trong năm nay và được cho là đã chọn Nasdaq làm địa điểm niêm yết. Việc lên sàn có thể củng cố cam kết minh bạch của công ty, nhưng cũng đòi hỏi huy động thêm vốn để hỗ trợ nghiên cứu mô hình. OpenAI, ngược lại, vẫn nghiêng về khả năng niêm yết vào năm 2027 và xem các vấn đề an toàn là một trong những yếu tố cần cân nhắc. Hai kế hoạch khác nhau cho thấy các công ty AI vẫn phải cân bằng giữa nhu cầu vốn, công bố thông tin quản trị và cam kết an toàn dài hạn.
Hội nghị AI tại Anh và nhận thức rủi ro của công chúng
Vua Charles III của Anh sẽ chủ trì một hội nghị AI tại điền trang Dumfries ở Scotland trong tuần này. Lãnh đạo của Nvidia, Google DeepMind, OpenAI và Anthropic dự kiến tham dự. Hội nghị có thể không đưa ra cam kết mang tính ràng buộc đối với toàn ngành, nhưng Vua Charles sẽ kêu gọi các bên bảo đảm AI luôn “phục vụ con người, cộng đồng và môi trường tự nhiên”. Hội nghị diễn ra trong bối cảnh ngành đang tranh luận về việc các mô hình tiên tiến có được phát triển quá nhanh hay không.
Một cuộc thăm dò mới cho thấy 63% người được hỏi tại Mỹ cho rằng rủi ro AI tiên tiến có thể hủy diệt nhân loại ít nhất ở mức “trung bình”. Trước khi kết quả được công bố, Jacob Coxon, cựu nhà nghiên cứu của Anthropic, đã công khai rời công ty và cảnh báo rằng các phòng thí nghiệm AI hàng đầu đang đặt đời sống công chúng vào rủi ro khi theo đuổi siêu trí tuệ có khả năng tự cải thiện. Sau đó, Amodei kêu gọi ngành kiểm soát tốc độ phát triển các mô hình tiên tiến, còn Altman ủng hộ các biện pháp bảo đảm an toàn chặt chẽ hơn.
Mối lo ngại của công chúng không hoàn toàn chia theo đảng phái. Trong số những người bỏ phiếu cho Kamala Harris vào năm 2024, 70% cho rằng rủi ro nói trên ít nhất ở mức trung bình. Tỷ lệ này là 60% trong nhóm ủng hộ Donald Trump. Khoảng 45% người được hỏi cho rằng nên tạm dừng phát triển các mô hình tiên tiến hơn, trong khi 40% muốn ngành tiếp tục tiến lên vì công nghệ vẫn có thể tạo ra những lợi ích đáng kể.
Hiện tranh luận tập trung vào ba câu hỏi cụ thể: có nên giới hạn tốc độ phát triển mô hình tiên tiến hay không, các đánh giá viên độc lập có được kiểm tra hệ thống nội bộ của doanh nghiệp hay không, và doanh nghiệp phải công bố thông tin trong bao lâu sau một sự cố an toàn. Khi các vụ mất kiểm soát trong thử nghiệm, hoạt động lừa đảo tự động và kế hoạch niêm yết lần lượt thu hút chú ý, ngành và cơ quan quản lý vẫn chưa thống nhất được cách chuyển cuộc tranh luận về các tiêu chuẩn an toàn có thể kiểm chứng và cơ chế phân định trách nhiệm.