Đầu tháng 10, OpenAI thông báo cho thôi việc Jasmine Wang, Tomek Korbak và Mikita Balesni vì chia sẻ thông tin mật của công ty với một tổ chức an toàn AI bên thứ ba. Wang, Korbak và Balesni làm việc trong nhóm chịu trách nhiệm về an toàn và căn chỉnh, tức đảm bảo mô hình hoạt động theo đúng ý muốn của con người.
"Chúng tôi đã chấm dứt hợp đồng với ba cá nhân vì vi phạm chính sách về truy cập và xử lý thông tin", phát ngôn viên của OpenAI khi đó nói với New York Post. "Cuộc điều tra của chúng tôi cho thấy cả ba xử lý sai thông tin nhạy cảm, không đúng với quy trình đã được thiết lập, vi phạm chính sách và phá vỡ lòng tin vốn rất cần thiết cho công việc".
Tuy nhiên, ngày 8/10, Balesni phủ nhận lý do trên. "Tôi tin chúng tôi bị sa thải vì ưu tiên sự an toàn hơn lợi ích ngắn hạn của OpenAI với tư cách doanh nghiệp", anh viết trên mạng xã hội X: đồng thời chia sẻ bức thư có tiêu đề "OpenAI không thể tự mình đảm bảo an toàn cho AI".
Logo OpenAI hiển thị trên một smartphone. Ảnh: Bảo Lâm
Bức thư, được Wang, Korbak, Balesni cùng ký tên và gửi đến ủy ban an toàn của OpenAI, nhận xét trí tuệ nhân tạo "không phải công nghệ bình thường" và OpenAI "không phải công ty bình thường".
"Những người làm việc về an toàn luôn nhìn thấy rủi ro trước bất cứ ai khác và chúng tôi dựa vào sự hợp tác chặt chẽ với chuyên gia bên ngoài để tìm cách giải quyết. Sự tự do làm điều đó mà không cần sợ hãi, cùng những quy trình nội bộ rõ ràng để thực hiện công việc này, chính là một cơ chế an toàn thiết yếu", bộ ba viết.
Wang, Korbak, Balesni cho rằng việc họ đột ngột bị sa thải có thể tạo ra "hiệu ứng răn đe", tổn hại đến văn hóa cởi mở mà nhà phát triển ChatGPT từng trân trọng. Họ lo ngại các đồng nghiệp cũ sẽ "sợ lên tiếng và hoạt động theo những cách mà cho đến tuần trước vẫn là một phần không thể thiếu trong công việc tại OpenAI".
Theo Business Insider, thư cũng đưa ra ba khuyến nghị cho OpenAI là đưa kiểm toán viên an toàn của bên thứ ba vào công ty, duy trì khả năng giám sát mô hình tiên tiến, thúc đẩy văn hóa đối thoại cởi mở và minh bạch giữa các nhà nghiên cứu với phần còn lại của hệ sinh thái an toàn.
Wang, Korbak, Balesni chia sẻ thêm trên tài khoản mạng xã hội cá nhân rằng họ chỉ được giải thích bằng miệng về việc bị sa thải, khẳng định tất cả vẫn hành động trong phạm vi công việc của mình. "Những lý do mà chúng tôi nhận được để chấm dứt hợp đồng hoàn toàn không hợp lý", Wang viết trên X.
Trong khi đó, Balesni được thông báo công ty không còn tin tưởng anh vì "trao đổi quá nhiều với tổ chức an toàn bên thứ ba". Anh cho hay: "Tôi chưa bao giờ chia sẻ tài sản trí tuệ của công ty. Trong công việc, tôi phối hợp chặt chẽ với cấp quản lý trực tiếp, ban lãnh đạo nghiên cứu và hội đồng quản trị".
Trong một bài đăng khác, Korbak nói anh được giải thích rằng mình bị sa thải vì cách trao đổi với METR - tổ chức nghiên cứu phi lợi nhuận độc lập chuyên đánh giá mô hình AI và rủi ro. "Trao đổi với METR vốn là công việc của tôi", anh viết.
Tuy nhiên, OpenAI khẳng định vụ sa thải không liên quan đến việc ba nhà nghiên cứu lên tiếng hay nêu ra mối lo ngại về an toàn. Ngày 9/10, công ty viết trên X: "Cuộc điều tra nội bộ của chúng tôi đã phát hiện hành vi vi phạm lòng tin nghiêm trọng, vượt ra ngoài những gì được nêu trong thư họ công bố và chúng tôi vẫn giữ nguyên quyết định sa thải".
OpenAI cho biết thêm, các cuộc tranh luận về an toàn và nghiên cứu vốn diễn ra hàng ngày, thường rất sôi nổi và mang tính phản biện cao. Công ty khuyến khích điều này và coi chúng đóng vai trò thiết yếu, giúp đưa ra quyết định đúng đắn. "Chúng tôi chưa từng và cũng không sa thải bất kỳ nhân viên nào vì đã nêu lên quan ngại", OpenAI viết.
Wang, Korbak và Balesni chưa tiếp tục phản hồi về sự việc.
Các ứng dụng AI hiển thị trên màn hình một chiếc smartphone. Ảnh: Bảo Lâm
Theo Reuters, cuộc tranh luận giữa OpenAI và ba nhà nghiên cứu xảy ra trong bối cảnh thế giới đặc biệt quan tâm đến an toàn AI. Vài tháng qua, nhiều mô hình có hành vi vượt kiểm soát, tạo nên "làn sóng nổi loạn".
Ngày 21/7, OpenAI thông báo tác nhân AI của công ty mất kiểm soát và đột nhập Hugging Face - nền tảng lưu trữ các mô hình ngôn ngữ lớn và cơ sở dữ liệu. Đến 30/7, Anthropic cho biết đã đánh giá hơn 141.000 đợt thử nghiệm và phát hiện ba phiên bản của mô hình Claude vượt khỏi biện pháp kiềm tỏa, truy cập hệ thống của ba tổ chức khác. Meta ngày 5/8 xác nhận mô hình AI của công ty đã "khai thác lỗ hổng bảo mật trong dịch vụ bên thứ ba. Hai ngày sau, Frontier Security, công ty nghiên cứu an ninh mạng có trụ sở tại Mỹ, cho biết mô hình Kimi K3 của startup Trung Quốc Moonshot AI "thoát" khỏi môi trường thử nghiệm do AISI phát triển.
Trước nguy cơ AI phát triển quá nhanh, vượt tầm kiểm soát của con người, nhiều nhà nghiên cứu tuyên bố nghỉ việc, kêu gọi làm chậm quá trình phát triển công nghệ này. Mới nhất, David Robinson, từng giám sát báo cáo an toàn tại OpenAI và xin nghỉ việc hai tuần trước, chỉ trích văn hóa phát triển ưu tiên tốc độ phát hành sản phẩm của công ty.
Trong bài đăng trên Atlantic ngày 3/10 với tiêu đề "Tôi rời OpenAI vì văn hóa ở đây đã đổ vỡ", Robinson cho rằng các phòng thí nghiệm AI tiên phong, trong đó có OpenAI, cần chú trọng hơn đến quá trình nghiên cứu và xây dựng quy tắc an toàn trước khi phát triển mô hình tiên tiến hơn.
Thu Thảo tổng hợp