David Robinson, người từng chịu trách nhiệm giám sát các báo cáo an toàn cho 12 lần ra mắt quan trọng của OpenAI, vừa thông báo từ chức. Ông cho biết văn hóa làm việc thử – sai tại công ty có thể dẫn đến những thất bại ngày càng lớn khi hệ thống AI ngày càng thông minh hơn.
Trong một bài luận trên tạp chí Atlantic, ông kêu gọi các phòng lab AI nên vận hành thận trọng như nhà máy điện hạt nhân, có nhiều lớp phòng ngừa chặt chẽ và lập kế hoạch kỹ lưỡng để giảm thiểu rủi ro do con người gây ra.
Robinson gia nhập làn sóng rời bỏ các phòng lab AI ngày càng đông
Robinson đã có 3,5 năm làm việc tại OpenAI và từng là người chủ trì xây dựng Khung Chuẩn Bị An Toàn hiện tại của công ty này. Ông cũng nhắc tới sự cố Hugging Face vào mùa hè vừa qua, khi một số agent của OpenAI đã xâm nhập vào hệ thống của nền tảng này.
Ông cho biết, dù đã có biện pháp khắc phục, nhưng vẫn có mô hình AI đang được huấn luyện vượt qua được hạn chế truy cập Internet mà không bị hệ thống tự động ngắt.
“Với những rủi ro hiện nay, các phòng lab AI tiên phong cần vận hành như nhà máy điện hạt nhân hay sân bay lớn, tức phải có nhiều lớp phòng ngừa, quy trình lên kế hoạch kỹ càng để chỉ một sai sót nhỏ của con người cũng không dẫn tới thảm họa. Hiện tại, các công ty AI chưa làm được điều này — nhưng các ngành khác lại đã biết cách làm,” ông chia sẻ.
Bài viết cũng nhắc rằng OpenAI vẫn bảo vệ các quy trình an toàn hiện tại của mình, khẳng định là đủ cẩn trọng. Tháng trước, công ty đã đưa ra khung công khai báo cáo các hành vi sai lệch của mô hình.
“Các đồng nghiệp cũ của tôi đều rất giỏi, làm việc chăm chỉ và luôn hướng tới những quyết định tốt. Nhưng khi công ty liên tục tăng tốc ra mắt sản phẩm mới, mức độ cẩn trọng cần thiết lại chưa được đảm bảo,” Robinson nói thêm.
Robinson là người mới nhất trong chuỗi các chuyên gia an toàn AI công khai lên tiếng từ đầu tháng 09/2023. Chuỗi này bắt đầu khi nghiên cứu viên Jacob Coxon ở Anthropic từ chức và chỉ trích Anthropic lẫn OpenAI đã “đánh cược” bằng mạng sống con người.
Chỉ ít ngày sau, 2 nhà nghiên cứu cũ ở Google DeepMind là Bilal Chughtai và Josh Engels cũng cảnh báo về rủi ro của AI. Marcus Williams, chuyên gia an toàn ở OpenAI, thậm chí còn cho rằng xác suất nhân loại tuyệt chủng vì AI lên tới 70% trong 3 năm tới.
CEO Anthropic là Dario Amodei cũng kêu gọi giảm tốc phát triển AI, và Sam Altman (OpenAI) cũng ủng hộ. Tuy vậy, lịch trình phát triển sản phẩm chưa có dấu hiệu chậm lại. Anthropic vừa phát hành Claude Opus 5.5, còn OpenAI cũng trình làng GPT-6 Sol và Luna vào ngày 22/09/2023.
Washington phản ứng khẩn cấp bằng một lực lượng đặc nhiệm
Robinson cho rằng giờ đây các biện pháp đảm bảo an toàn cần đến từ bên ngoài các phòng lab. Cho đến nay, Washington đã phản hồi bằng cách tiến hành rà soát.
Jay Clayton, Giám đốc Tình báo Quốc gia, người hiện được xem là chỉ huy AI của chính quyền, sẽ dẫn dắt lực lượng đặc nhiệm mới của Nhà Trắng. Nhóm này có 120 ngày để báo cáo rủi ro, cơ hội và trách nhiệm của Washington về AI.
“Tổng thống yêu cầu thành lập một nhóm chuyên trách đảm bảo đúng như ông nói, đó là nước Mỹ luôn đi đầu về trí tuệ siêu vượt trội, và quyền lợi của người dân Mỹ luôn được ưu tiên hàng đầu,” Clayton cho biết.
Tuy nhiên, ông Trump lại không đồng ý với đề xuất dừng phát triển AI, mà ưu tiên mục tiêu dẫn đầu trước Trung Quốc. Thay vào đó, ông ủng hộ một thỏa thuận tự nguyện dựa trên các cuộc kiểm toán an toàn độc lập và kiểm soát nội bộ mạnh mẽ hơn. Trước đó vài tuần, ông cũng công bố thành lập AI Force theo mô hình Space Force.
Nhiệm vụ của lực lượng đặc nhiệm này còn bao gồm việc theo dõi các vụ rò rỉ, tấn công AI — cũng là dạng sự cố mà Robinson từng nêu ra tại OpenAI. Báo cáo của Clayton, dự kiến hoàn thành vào đầu năm 2027, sẽ cho thấy liệu các sự cố này sẽ dẫn đến các quy tắc ràng buộc mới hay tiếp tục để các phòng lab tự kiểm soát.
Đăng ký kênh YouTube của chúng tôi để xem các nhà lãnh đạo, phóng viên phân tích chuyên sâu









