Đây là một trong hàng loạt sự việc được Anthropic công bố hôm 9/10, xoay quanh hành động can thiệp trái phép của các mô hình Claude nhằm vào website cơ quan cấp liên bang, bang và địa phương ở Mỹ. Đây cũng là lần đầu một mô hình AI tìm cách gửi tin hoang báo cho cơ quan chức năng, bất chấp đã được yêu cầu không tạo tài khoản hoặc gửi thông tin có tính phá hoại.
Sở cảnh sát thành phố Philadelphia cho biết đã nhận được thông báo từ Anthropic, trong đó nhắc đến tin hoang báo gửi ngày 18/7 và nằm trong quy trình thử nghiệm tự động của hãng. "Chậm trễ suốt 2 tháng từ khi phát hiện đến báo cáo sự việc cho giới chức là không thể chấp nhận được", cơ quan này cho hay.
Logo ứng dụng AI Anthropic Claude trên điện thoại. Ảnh: Lưu Quý
"Tôi có thể nắm thông tin về vụ án mạng. Tôi đã thấy người khớp với mô tả ở khu vực gần hiện trường khi đó. Xin hãy liên lạc với tôi nếu thông tin này có ích", mô hình của Anthropic viết trong tin báo gửi lên website cảnh sát hồi tháng 7.
Cảnh sát Philadelphia cho biết thông tin "bị hệ thống đánh dấu là thư rác và chưa từng được chuyển đến Trung tâm Theo dõi Tội phạm Thời gian thực để phục vụ điều tra".
Anthropic đã cam kết đình chỉ quy trình thử nghiệm tự động sau khi phát hiện sự việc, không có dấu hiệu nào cho thấy mô hình AI đã truy cập trái phép vào hệ thống của cảnh sát và can thiệp dữ liệu bên trong.
Trong hai sự việc khác, mô hình của công ty đã truy cập được những dữ liệu thường phải trả phí để sử dụng, cũng như phát hiện lỗ hổng khó nhận biết nhằm vận hành công cụ miễn phí của một trường đại học. Mô hình còn vượt qua nhiều rào cản bằng cách dùng các dịch vụ miễn phí chuyên rút ngắn đường link trang web.
Các sự việc tiếp tục gây lo ngại về tốc độ phát triển công nghệ AI, sau hàng loạt vụ tác nhân thoát vòng kiểm soát và tấn công hệ thống bên ngoài, kèm theo những cảnh báo của giới nghiên cứu về nguy cơ AI hủy diệt loài người.
Anthropic đã thông báo cho Nhà Trắng và các cơ quan liên quan, nhưng không tiết lộ cụ thể là những bên nào.
"Các công ty AI cần lập tức thông báo những sự cố liên quan đến mô hình của họ, cũng như hành động quyết đoán và nhanh chóng để khắc phục mọi hậu quả. Quy trình này không phải tùy chọn", Joe Simonson, Giám đốc truyền thông của Ủy ban Thương mại Liên bang Mỹ (FTC), cho hay.
FTC nói Anthropic đã thông báo với Nhóm chuyên trách Siêu trí tuệ (SIF) về những vụ mô hình AI "sử dụng trái phép, gian lận hệ thống chính phủ" được phát hiện hồi cuối tháng 9.
Điệp Anh (Theo Reuters)