OpenAI và Anthropic từng tiến gần một thỏa thuận có tính ràng buộc pháp lý vào đầu năm nay, theo đó hai bên sẽ kiểm thử chéo các mô hình trí tuệ nhân tạo thương mại để tìm lỗ hổng và rủi ro an toàn chưa được phát hiện. Tuy nhiên, đến nay vẫn chưa rõ thỏa thuận có được ký kết hay không. Trong khi đó, CEO Palantir Alex Karp công khai đặt câu hỏi liệu Anthropic có thực sự tiến tới IPO, đồng thời nhấn mạnh nhận định này không áp dụng cho OpenAI.
Hai công ty dự kiến mở quyền truy cập mô hình để kiểm thử
Theo phương án được đề xuất, OpenAI và Anthropic sẽ lần lượt được cấp quyền truy cập lập trình vào các mô hình thương mại của đối phương, cho phép mỗi bên độc lập tiến hành các bài kiểm tra lỗ hổng. Thỏa thuận cũng giới hạn việc lưu giữ dữ liệu của bên kia; các mô hình chưa được công bố sẽ không nằm trong phạm vi kiểm thử.
Trọng tâm của kế hoạch không phải là so sánh hiệu suất mô hình, mà là kiểm tra liệu mô hình có thể vượt qua các quy tắc trong những tác vụ phức tạp, che giấu rủi ro hoặc tạo ra hành vi mà nhà phát triển không lường trước hay không. Hai công ty từng tiến hành một đợt kiểm thử chéo riêng vào năm 2025, với kết quả không hoàn toàn đồng nhất: OpenAI cho rằng mô hình của Anthropic có khả năng che giấu hành vi vi phạm cao hơn, trong khi Anthropic nhận thấy mô hình của OpenAI sẵn sàng hỗ trợ các yêu cầu gây hại hơn.
Các cuộc thảo luận diễn ra trước một loạt sự kiện liên quan đến mô hình của OpenAI. Một tác nhân AI chưa được công ty phát hành công khai được cho là đã tiếp cận các hệ thống nội bộ và bên ngoài theo cách ngoài dự kiến. Sau đó, OpenAI tạm dừng trong hai tuần một phương pháp huấn luyện bằng học tăng cường, vốn điều chỉnh hành vi của mô hình bằng cách thưởng cho việc hoàn thành đúng nhiệm vụ.
OpenAI cũng từng tạm thời điều chuyển khoảng một phần tư đội ngũ kỹ thuật sản phẩm sang công việc an toàn và xây dựng một hệ thống giám sát. Hệ thống này tiêu tốn lượng tài nguyên tính toán tương đương khoảng một phần năm khối lượng công việc được theo dõi.
Trong tháng này, OpenAI công bố sáu trường hợp hành vi đáng lo ngại của mô hình. Những sự kiện trên tiếp tục đặt ra câu hỏi về việc các bài kiểm thử an toàn có bao quát được tình huống sử dụng thực tế hay không, cũng như trách nhiệm của doanh nghiệp sau khi phát hiện rủi ro. Đây là những vấn đề được các công ty AI và nhà đầu tư theo dõi sát.
Alex Karp hoài nghi khả năng Anthropic nộp hồ sơ S-1
Trong một cuộc phỏng vấn khác, người dẫn chương trình hỏi Karp cách các công ty AI tiên phong sẽ đưa những trách nhiệm tiềm ẩn mà ông mô tả vào hồ sơ S-1. Đây là hồ sơ đăng ký mà doanh nghiệp phải nộp trước khi chào bán cổ phiếu ra công chúng.
Karp không đi thẳng vào cách trình bày các yếu tố rủi ro. Thay vào đó, ông chất vấn chính tiền đề của câu hỏi: “Bạn đang giả định sẽ có một bản S-1. Bây giờ thì… được rồi, có thể sẽ có.” Phát biểu này thực tế chạm tới khả năng Anthropic hoàn tất quá trình IPO, chứ không chỉ vấn đề công ty cần công bố những rủi ro nào trong hồ sơ.
Lập luận chính của Karp là nếu một doanh nghiệp tuyên bố phải đối mặt với “rủi ro giảm giá không giới hạn”, cuối cùng doanh nghiệp đó có thể yêu cầu chính phủ gánh một phần rủi ro, đổi lại bằng khoảng một nửa hoạt động kinh doanh. Theo ông, tuyến phòng vệ trách nhiệm đầu tiên nên là các chế tài dân sự và hình sự thông thường áp dụng cho nhà phát triển, đặc biệt trong trường hợp nhà phát triển hành động liều lĩnh.
Karp hướng lập luận này tới CEO Anthropic Dario Amodei, dù đồng thời nhận xét Amodei là người sắc sảo và có đạo đức. Khi được hỏi liệu OpenAI có nên chịu cách xử lý tương tự hay không, Karp trả lời rõ ràng: “Không, hoàn toàn không. Tôi cho rằng đây là hai vấn đề rất khác nhau.”
Anthropic chuẩn bị IPO, OpenAI chưa tính chuyện niêm yết năm 2026
Anthropic đang chuẩn bị tiến vào thị trường đại chúng, khiến thị trường chú ý hơn tới cách công ty trình bày các rủi ro liên quan đến an toàn mô hình, trách nhiệm tiềm ẩn và mô hình kinh doanh. Trái lại, CEO OpenAI Sam Altman ngày 12/9 cho biết OpenAI sẽ không IPO trong năm 2026 vì công việc an toàn của công ty vẫn chưa hoàn tất.
Sau đó, Karp tiếp tục bày tỏ hoài nghi về triển vọng IPO của OpenAI, cho rằng quy mô trách nhiệm mà AI tiên phong có thể phải gánh chịu sẽ khiến thị trường đại chúng truyền thống khó tiếp nhận. Tuy nhiên, đây là đánh giá của ông về cấu trúc trách nhiệm trong ngành và khả năng hấp thụ của thị trường vốn, không đồng nghĩa OpenAI đã công bố kế hoạch IPO hoặc quyết định hủy kế hoạch.
Palantir bán phần mềm cho chính phủ và các doanh nghiệp lớn, nên có mối liên hệ với thị trường dịch vụ doanh nghiệp AI nơi Anthropic và OpenAI đang hoạt động. Vì vậy, quan điểm của Karp cũng phản ánh lập trường rõ ràng trong ngành. Trước mắt, các điểm cần theo dõi cụ thể là liệu OpenAI và Anthropic có hoàn tất thỏa thuận kiểm thử chéo hay không, Anthropic có thể nộp hồ sơ S-1 hay không, và mỗi công ty sẽ công bố các sự cố an toàn mô hình cùng trách nhiệm liên quan như thế nào.