Hộp đen của An toàn AI: Cách Sol của OpenAI được "bật đèn xanh"
Khi OpenAI triển khai mô hình tiên phong mới nhất của mình, Sol, một câu hỏi quan trọng đang ám ảnh ngành công nghệ: chính xác thì chính phủ đã quyết định thế nào để cho rằng mô hình này an toàn cho việc phát hành công khai? Trong khi Sol đặt mục tiêu cạnh tranh với Fable của Anthropic—một mô hình từng bị Nhà Trắng hạn chế—thì sự thiếu minh bạch liên quan đến quy trình phê duyệt đang gây ra những tranh luận gay gắt giữa các nhà quản lý và các nhà nghiên cứu.
Sự thiếu hụt các giao thức an toàn tiêu chuẩn hóa
Bất chấp những rủi ro lớn khi triển khai các mô hình tiên phong, hiện vẫn chưa có một khung làm việc thống nhất và minh bạch nào cho việc chứng nhận an toàn AI. Mặc dù CEO của OpenAI, Sam Altman, đã xác nhận rằng các cuộc thảo luận đã diễn ra với các quan chức cấp cao—bao gồm Bộ trưởng Thương mại Howard Lutnick và Giám đốc An ninh mạng Quốc gia Hoa Kỳ Sean Cairncross—nhưng các tiêu chuẩn kỹ thuật cụ thể được sử dụng để xác thực Sol vẫn chưa được tiết lộ.
Bối cảnh quản lý hiện tại được các chuyên gia mô tả là "ad hoc" (tạm thời/tự phát). Mặc dù một sắc lệnh hành pháp gần đây đã vạch ra lộ trình đánh giá các mô hình tiên phong, nhưng các chi tiết cụ thể vẫn đang trong quá trình hoàn thiện. Quan trọng hơn, không có một "FDA dành cho AI", một quan điểm được cựu cố vấn AI của Nhà Trắng, Sriram Krishnan, đồng tình. Sự thiếu vắng một cơ quan quản lý tập trung này đồng nghĩa với việc các đánh giá an toàn hiện đang dựa vào một tập hợp chắp vá các quy trình nội bộ của công ty và các cuộc kiểm toán bên ngoài tự nguyện.
Sự căng thẳng giữa Đổi mới và Quản lý
Việc phát hành Fable của Anthropic làm nổi bật sự biến động của môi trường chưa được kiểm soát này. Fable đã bị cấm truy cập công khai tạm thời đối với các công dân nước ngoài do những lo ngại về khả năng "jailbreaking" có thể tạo điều kiện cho việc hack. Ngược lại, Sol của OpenAI đã tiến tới việc phát hành rộng rãi sau một thời gian dùng thử mô hình cho một số người dùng chính phủ được chọn lọc.
Sự chênh lệch này đã gây ra những nghi ngại về ảnh hưởng của các mối quan hệ chính trị. Các báo cáo về việc ban lãnh đạo OpenAI làm việc với chính quyền đã khiến một số quan sát viên đặt câu hỏi liệu một cách tiếp cận quản lý "nới lỏng hơn" có đang được áp dụng hay không. Đối với các nhà phát triển và nhà sáng lập, điều này tạo ra một môi trường bấp bênh, nơi việc triển khai mô hình có thể phụ thuộc vào các thủ thuật chính trị nhiều hơn là vào các tiêu chuẩn an toàn kỹ thuật được chuẩn hóa.
Hướng tới Kiểm toán bên thứ ba và Không gian chung mở
Các nhà lãnh đạo trong ngành đang kêu gọi một sự thay đổi về cấu trúc để ngăn chặn tình trạng "gatekeeping" (kiểm soát cửa ngõ) bởi một số ít những người ra quyết định. Nhà khoa học máy tính Andy Konwinski cho rằng quy trình hiện tại đang thiếu sự đóng góp đầy đủ từ các chuyên gia thực thụ: các nhà nghiên cứu về an toàn, alignment (sự căn chỉnh) và interpretability (khả năng diễn giải).
Để giải quyết vấn đề này, hai mô hình chính cho tương lai đã xuất hiện:
- Mô hình Thể chế: Mô phỏng theo FDA hoặc NIH, mô hình này sẽ bao gồm việc triệu tập các nhà nghiên cứu, quan chức chính phủ và các công ty tư nhân để đạt được sự đồng thuận về các tiêu chuẩn an toàn.
- Mô hình Kiểm toán bên thứ ba: Như gợi ý của cựu cố vấn chính sách Dean W. Ball, chính phủ có thể cấp phép cho các tổ chức kiểm toán độc lập để đánh giá các giao thức an toàn của các phòng thí nghiệm tiên phong.
Để hệ sinh thái AI đạt được sự ổn định lâu dài, ngành công nghiệp này phải thoát khỏi các cuộc đàm phán riêng tư và hướng tới một khung làm việc có thể dự đoán được, do các chuyên gia dẫn dắt, nhằm cân bằng giữa trách nhiệm ủy thác và an toàn công cộng.
Các điểm chính cần lưu ý
- Sự mơ hồ về quản lý: Hiện chưa có "giấy phép an toàn" tiêu chuẩn hóa hoặc cơ quan tập trung nào (như FDA) quản lý việc phát hành các mô hình tiên phong như Sol.
- Khoảng cách về sự minh bạch: Mặc dù OpenAI dẫn chứng các đánh giá bên ngoài từ U.K. AISI và SecureBio, nhưng các cuộc đối thoại cụ thể với chính phủ và các yêu cầu kỹ thuật để phê duyệt mô hình vẫn còn mờ mịt.
- Lời kêu gọi các chuyên gia: Các chuyên gia trong ngành đang ủng hộ các khung kiểm toán bên thứ ba và "không gian chung mở" (open commons) để đảm bảo các quyết định về an toàn được đưa ra bởi các nhà nghiên cứu thay vì các trung gian chính trị.
