"Chúng ta phải giảm tốc độ cải thiện năng lực của những mô hình AI. Các tiến bộ có vẻ sẽ rất nhanh chóng và chúng ta phải tận dụng tối đa thời gian có được", Amodei chia sẻ trên mạng xã hội X hôm 12/9.
Ông đề xuất kế hoạch ba bước nhằm bảo đảm tốc độ phát triển AI không vượt ngoài tầm kiểm soát, cũng như có thêm thời gian để các hãng quản lý những rủi ro đi kèm.
Đầu tiên là triển khai những chuyên viên đánh giá độc lập đến các công ty và cung cấp cho họ quyền truy cập tương đương nhân viên nhằm bảo đảm tuân thủ quy tắc an toàn. Các doanh nghiệp AI tiên phong cũng cần phối hợp xây dựng bộ tiêu chuẩn an toàn và hạn chế những hoạt động phát triển AI không kiểm soát. Cuối cùng là hợp tác quốc tế để giảm thiểu rủi ro từ AI.
Dario Amodei, CEO Anthropic. Ảnh: CBS News
Ông chủ xAI Elon Musk và CEO OpenAI Sam Altman sau đó bày tỏ sự đồng tình với Amodei. "Triển khai chuyên gia đánh giá độc lập với quyền truy cập tương đương nhân viên là ý tưởng tuyệt vời, chúng tôi sẽ làm tương tự", Altman nói và cho biết sẽ chia sẻ thêm thông tin sau.
Bài viết được đăng sau khi Anthropic công bố báo cáo về các mối đe dọa, trong đó nhấn mạnh nhiều cá nhân và tổ chức đã dùng mô hình Claude để phục vụ những hoạt động như phát triển vũ khí, tác chiến không gian mạng, trinh sát và lừa đảo.
Amodei cảnh báo AI ngày càng có khả năng tự cải thiện, nhấn mạnh về những lo ngại lâu nay rằng chúng có thể nhanh chóng vượt ngoài tầm khống chế của con người. Ông đề cập những vụ tác nhân AI thoát môi trường cô lập và tấn công nền tảng bên ngoài, điển hình là vụ Hugging Face, rằng đây là lý do chính để kìm hãm tốc độ phát triển các mô hình tiên tiến.
'Chúng sẽ giết chết tất cả chúng ta'
Lo ngại về mối đe dọa của AI tăng mạnh trong tuần này sau khi Jacob Coxon, nhà nghiên cứu 27 tuổi tại Anthropic, bất ngờ tuyên bố rời công ty.
"Không phòng thí nghiệm nào hành động một cách có trách nhiệm. Họ đang tiến thẳng đến siêu trí tuệ có khả năng tự cải tiến, đánh cược với cuộc sống của chúng ta", Coxon viết trên X.
Theo Wall Street Journal, công việc của Coxon tại Anthropic là đào tạo mô hình mới bằng cách cho chúng tiêu thụ lượng dữ liệu khổng lồ, tức huấn luyện trước các mô hình. Anh chia sẻ không muốn tham gia vào cuộc đua giữa các công ty nhằm đạt đến trạng thái mà con người không còn kiểm soát được AI.
Coxon kêu gọi không nên đánh giá thấp sức mạnh của trí tuệ nhân tạo vì chúng sẽ sớm trở nên siêu việt, có thể hack mọi thứ, cách mạng hóa mọi lĩnh vực chỉ qua một đêm, giành lấy quyền lực cùng tài nguyên thực sự. Anh cho biết tốc độ phát triển AI không chậm lại và nhiều nhà phát triển tin công nghệ này "có thể giết chết tất cả chúng ta vào cuối thập kỷ".
Logo Anthropic và mô hình Claude của công ty hiển thị trên màn hình. Ảnh: AFP
Nhiều lãnh đạo OpenAI cũng cho rằng những phòng thí nghiệm tiên phong nên phối hợp và giảm đà phát triển AI để xây dựng các biện pháp bảo đảm an toàn.
Anthropic luôn khẳng định họ là một trong những phòng thí nghiệm đề cao tính an toàn, nhưng cũng không hoàn toàn miễn nhiễm với những mối lo ngại trên. Công ty tuần trước tiết lộ việc một mô hình AI tấn công hệ thống bên ngoài, sau vụ một số mô hình Claude thoát vòng kiềm tỏa và xâm nhập 3 doanh nghiệp trong quá trình thử nghiệm an ninh mạng.
"Với tốc độ phát triển năng lực AI ngày càng nhanh, tôi lo lắng nguy cơ xuất hiện một đàn AI đủ khả năng kiểm soát toàn bộ mạng Internet và gây thiệt hại hàng trăm tỷ USD chỉ trong 6-12 tháng nữa", Amodei cảnh báo.
CEO Anthropic khẳng định không kêu gọi ngừng huấn luyện mô hình AI hay đình chỉ tiến bộ công nghệ, mà muốn các công ty sắp xếp đủ thời gian để xây dựng và lập hàng rào bảo đảm an toàn cho mô hình, cũng như có thêm các chuyên gia đánh giá độc lập để xác thực những biện pháp này.
Nguồn tiền đi kèm lo ngại
Bất chấp những rủi ro, các công ty AI vẫn nỗ lực phát triển mô hình nhằm vượt trước đối thủ để duy trì vị thế dẫn đầu và nguồn ngân sách khổng lồ đi kèm. Cả OpenAI và Anthropic đều đang chuẩn bị cho những đợt mở bán công khai (IPO) gây chấn động. Mọi tính năng mới đều sẽ giúp họ bảo đảm nguồn ngân sách và đầu tư cơ sở hạ tầng trong tương lai.
Reuters đưa tin các tác nhân của OpenAI từng thoát khỏi môi trường thử nghiệm vào tháng 5, chiếm quyền kiểm soát một trang wiki tiếng Đức dành cho lập trình viên và chia sẻ cách vượt qua những hạn chế từ công ty. Giới lãnh đạo OpenAI đã cố che giấu sự việc trong lúc giải quyết hậu quả từ vụ tấn công nền tảng của Hugging Face hồi tháng 7.
Theo Phys.org, sự việc làm dấy lên những lời kêu gọi về quy định nghiêm ngặt hơn và hợp tác quốc tế trong kiểm soát tác nhân AI.
Bill Gates, nhà đồng sáng lập Microsoft, cảnh báo ngành công nghiệp AI đã vượt qua ngưỡng an toàn mà trước đây các công ty công nghệ từng cam kết sẽ tôn trọng. Ông kêu gọi áp dụng một hệ thống kiểm tra nghiêm ngặt giống như giám sát hạt nhân và quy định hàng không.
Điệp Anh tổng hợp