Nhà nghiên cứu Anthropic từ chức vì lo AI vượt kiểm soát
Nguồn ảnh: VnExpress
Jacob Coxon, nhà nghiên cứu 27 tuổi tại Anthropic, bất ngờ tuyên bố rời công ty, đồng thời cảnh báo về rủi ro liên quan đến AI.
"Hôm nay, tôi từ chức tại Anthropic. Ba năm qua, tôi đã nghiên cứu về quá trình huấn luyện trước AI cả ở Anthropic và OpenAI. Không công ty nào hành động một cách có trách nhiệm. Họ đang tiến thẳng đến siêu trí tuệ có khả năng tự cải tiến, đánh cược với cuộc sống của chúng ta", Coxon viết trên X ngày 9/9.
Theo WSJ, công việc của Coxon tại Anthropic là đào tạo mô hình mới bằng cách cho chúng tiêu thụ lượng dữ liệu khổng lồ, tức huấn luyện trước các mô hình. Anh chia sẻ không muốn tham gia vào cuộc đua giữa các công ty nhằm đạt đến trạng thái mà con người không còn kiểm soát được AI.
"Tôi không nghĩ chúng ta đang đi đúng hướng để ngăn chặn một cuộc chạy đua toàn cầu. Điều này có thể đòi hỏi những hành động tốn kém như tạm thời cấm cải tiến năng lực của các mô hình", nhà nghiên cứu này cho hay.
Coxon kêu gọi không nên đánh giá thấp sức mạnh của trí tuệ nhân tạo vì chúng sẽ sớm trở nên siêu việt, có thể hack mọi thứ, cách mạng hóa mọi lĩnh vực chỉ qua một đêm, giành lấy quyền lực cùng tài nguyên thực sự. Anh cho biết, tốc độ phát triển AI không hề chậm lại và nhiều nhà phát triển tin công nghệ này "có thể giết chết tất cả chúng ta vào cuối thập kỷ".
Evan Hubinger, Trưởng nhóm Khoa học Điều chỉnh tại Anthropic, phản hồi dưới bài đăng của đồng nghiệp cũ: "Jacob nói đúng. Chúng tôi thực sự tin AI có thể tiêu diệt nhân loại. Cá nhân tôi nghĩ khả năng này đạt hơn 10% trong thập kỷ tới".
Tuy nhiên, Hubinger tin Anthropic đang nỗ lực tối đa, dù chưa có kế hoạch rõ ràng nhằm giải quyết vấn đề với siêu trí tuệ. "Tôi nghĩ rủi ro từ những mô hình hiện khá thấp. Điều tôi lo ngại là siêu trí tuệ ra đời từ quá trình tự cải tiến đang tới nhanh hơn chúng ta tưởng", Hubinger nói thêm.
Logo Anthropic hiển thị trên màn hình smartphone. Ảnh: Bảo Lâm
Đầu tuần này, theo Bloomberg, nhà khoa học trưởng Jakub Pachocki tại OpenAI, đối thủ lớn của Anthropic, cũng bày tỏ nỗi lo tương tự. "Đây là giai đoạn đòi hỏi sự thận trọng cực độ. Tôi lo ngại chưa ai sẵn sàng cho hệ quả của việc trí tuệ máy móc liên tục phát triển nhanh", Pachocki cho hay, thêm rằng các nhà phát triển nên điều chỉnh AI sao cho phù hợp hơn với lợi ích của con người hoặc "làm chậm quá trình phát triển trong tương lai nếu cần".
"Tôi trông đợi và hy vọng việc tự nguyện giảm tốc sẽ trở nên phổ biến cho đến khi các tiêu chuẩn an toàn chung được thiết lập", Pachocki nhấn mạnh.
Hồi tháng 6, Anthropic kêu gọi các nhà phát triển AI hàng đầu cân nhắc thiết lập một cơ chế phối hợp để làm chậm hoặc tạm dừng quá trình phát triển nếu AI bắt đầu tự cải tiến với tốc độ vượt sức quản lý rủi ro của xã hội.
Thu Thảo tổng hợp
Jacob Coxon, nhà nghiên cứu từng làm việc tại Anthropic và OpenAI, tuyên bố từ chức khỏi Anthropic ngày 9/9 vì lo ngại cuộc đua phát triển trí tuệ nhân tạo đang vượt khỏi khả năng kiểm soát của con người. Trong thông báo đăng trên X, Coxon cho biết ba năm qua, ông nghiên cứu quá trình huấn luyện trước AI, lĩnh vực sử dụng lượng dữ liệu khổng lồ để đào tạo các mô hình mới. Theo Coxon, cả Anthropic lẫn OpenAI đều chưa hành động đủ trách nhiệm, trong khi đang tiến nhanh tới những hệ thống có thể tự cải tiến và đạt tới trạng thái siêu trí tuệ. Công việc của Coxon tại Anthropic, theo The Wall Street Journal, tập trung vào huấn luyện trước mô hình bằng cách cho chúng tiếp nhận và xử lý khối lượng dữ liệu rất lớn.
Nhà nghiên cứu này nói ông không muốn tiếp tục tham gia cuộc cạnh tranh giữa các công ty công nghệ, khi mục tiêu cuối cùng có thể khiến con người không còn kiểm soát được AI. Ông nhận định thế giới chưa đi đúng hướng để ngăn chặn một cuộc chạy đua toàn cầu, đồng thời cảnh báo giải pháp cần thiết có thể bao gồm việc tạm thời cấm cải tiến năng lực mô hình. Coxon kêu gọi công chúng không đánh giá thấp sức mạnh của AI, bởi các hệ thống tương lai có thể nhanh chóng trở nên vượt trội, tác động sâu rộng tới nhiều mặt đời sống. Ông cảnh báo AI siêu trí tuệ có thể hack mọi thứ, làm thay đổi hàng loạt lĩnh vực chỉ sau một đêm, rồi giành quyền lực cùng những nguồn tài nguyên quan trọng.
Theo Coxon, tốc độ phát triển AI hiện không hề chậm lại, trong khi nhiều nhà phát triển tin công nghệ này có thể gây ra thảm họa nghiêm trọng cho nhân loại vào cuối thập kỷ. Những cảnh báo ấy nhận được phản hồi trực tiếp từ Evan Hubinger, Trưởng nhóm Khoa học Điều chỉnh tại Anthropic, người từng là đồng nghiệp của Coxon. Hubinger viết dưới bài đăng rằng Coxon nói đúng, đồng thời thừa nhận nhiều người tại Anthropic thực sự tin AI có khả năng tiêu diệt nhân loại trong tương lai. Cá nhân Hubinger đánh giá xác suất kịch bản đó xảy ra trong thập kỷ tới ở mức hơn 10%, con số cho thấy mức độ nghiêm trọng của những lo ngại trong nội bộ ngành.
Dù vậy, Hubinger cho rằng Anthropic đang nỗ lực tối đa để xử lý rủi ro, dù công ty hiện chưa có kế hoạch rõ ràng nhằm giải quyết vấn đề siêu trí tuệ. Ông phân biệt giữa các mô hình hiện nay và hệ thống tương lai, nhận định rủi ro từ những mô hình đang tồn tại vẫn khá thấp so với mối nguy lớn hơn. Điều khiến Hubinger lo lắng là siêu trí tuệ hình thành thông qua quá trình tự cải tiến có thể xuất hiện nhanh hơn dự đoán, trước khi xã hội kịp chuẩn bị biện pháp ứng phó. Những quan ngại tương tự cũng xuất hiện tại OpenAI, đối thủ lớn của Anthropic, khi nhà khoa học trưởng Jakub Pachocki lên tiếng vào đầu tuần này.
Theo Bloomberg, Pachocki cho rằng ngành AI đang bước vào giai đoạn đòi hỏi sự thận trọng cực độ, bởi máy móc có thể liên tục phát triển nhanh hơn khả năng chuẩn bị. Ông lo ngại chưa ai sẵn sàng cho những hệ quả phát sinh khi trí tuệ máy móc tiến bộ liên tục, đặc biệt nếu quá trình này diễn ra ngoài dự đoán của các nhà phát triển. Pachocki kêu gọi điều chỉnh AI để công nghệ phù hợp hơn với lợi ích con người, đồng thời sẵn sàng làm chậm quá trình phát triển trong tương lai nếu tình hình đòi hỏi. Nhà khoa học trưởng OpenAI cũng hy vọng việc các công ty tự nguyện giảm tốc sẽ trở nên phổ biến, ít nhất cho tới khi những tiêu chuẩn an toàn chung được thiết lập.
Quan điểm này cho thấy lo ngại về AI không chỉ xuất hiện ở những nhà nghiên cứu đã rời công ty, mà còn được chia sẻ bởi các lãnh đạo khoa học đang làm việc trong ngành. Hồi tháng 6, Anthropic từng kêu gọi các nhà phát triển AI hàng đầu cân nhắc thiết lập cơ chế phối hợp, nhằm làm chậm hoặc tạm dừng phát triển khi rủi ro vượt khả năng quản lý. Đề xuất của Anthropic tập trung vào kịch bản AI bắt đầu tự cải tiến nhanh hơn sức kiểm soát của xã hội, qua đó đặt ra yêu cầu phối hợp thay vì chỉ cạnh tranh giữa các công ty. Các phát biểu từ Coxon, Hubinger và Pachocki phản ánh một nghịch lý lớn, khi những người thúc đẩy AI cũng đồng thời cảnh báo tốc độ tiến bộ có thể trở thành mối đe dọa.
Thông tin do VnExpress tổng hợp cho thấy cuộc tranh luận hiện không còn chỉ xoay quanh khả năng của AI, mà mở rộng sang câu hỏi con người phải kiểm soát cuộc đua này như thế nào.