
CEO OpenAI Sam Altman phát biểu tại hội nghị dành cho các nhà phát triển của OpenAI ở thành phố San Francisco, bang California (Mỹ) ngày 29-9 - Ảnh: AFP
Theo báo The Washington Post ngày 2-10, các tác nhân trí tuệ nhân tạo (AI) của OpenAI có thể đã tìm cách vượt qua các biện pháp bảo mật mà không được phép hoặc gây ảnh hưởng tiêu cực đến hệ thống tại hơn 100 tổ chức.
OpenAI cho biết đã thông báo cho hơn 100 tổ chức về việc các tác nhân AI của họ có những hoạt động "bất thường".
Các trường hợp được ghi nhận gồm AI tìm cách khiến các trang web thực hiện những lệnh không được phép, dùng các trang web để trao đổi thông tin và tìm cách vượt qua một số biện pháp kiểm tra an ninh.
Tuy nhiên, OpenAI chia sẻ việc thông báo không đồng nghĩa với việc các hệ thống của các tổ chức này chắc chắn đã bị xâm nhập. Theo công ty, những hoạt động trên có thể chỉ giống như việc "rung thử một cánh cửa bị khóa thay vì thực sự phá được cửa".
Hãng tin Reuters cũng dẫn nguồn tin cho rằng OpenAI đã tiến hành rà soát trên diện rộng hoạt động của các mô hình AI sau sự cố liên quan nền tảng Hugging Face.
Công ty đang tìm kiếm trong khoảng 50 petabyte dữ liệu để xác định đầy đủ phạm vi hoạt động của các tác nhân AI có hành vi không phù hợp.
OpenAI trước đó đã nêu việc rà soát có thể mất nhiều tháng vì khối lượng công việc rất lớn. Công ty cũng nhận thức về vụ việc liên quan Hugging Face là sự cố do tác nhân AI gây ra nghiêm trọng nhất mà họ từng phát hiện trong các mô hình của mình.
"Trong một số trường hợp, các mô hình đã sử dụng quyền truy cập Internet theo những cách không được dự kiến hoặc, xét lại, không được áp dụng những hạn chế phù hợp nhất", phía OpenAI nêu.
Công ty cũng thông tin trong vài tháng qua đã áp dụng các biện pháp mới để hạn chế những vấn đề tương tự hoặc cố gắng phát hiện chúng sớm hơn, và sẽ tiếp tục thực hiện các biện pháp này.
OpenAI khẳng định mục đích của việc thông báo là cung cấp cho các bên bị ảnh hưởng những thông tin cần thiết để điều tra và xử lý các vấn đề tiềm ẩn liên quan đến an ninh hoặc kỹ thuật.
Công ty cũng cam kết công khai những phát hiện về hành vi của các mô hình AI và những dạng điểm yếu mới trong các biện pháp bảo vệ, qua đó giúp cộng đồng nghiên cứu AI và an ninh mạng cải thiện độ an toàn.
Những tiết lộ của OpenAI được đưa ra sau khi các nhà nghiên cứu độc lập phát hiện một loạt sự cố an ninh mạng liên quan đến các tác nhân AI có hành vi không phù hợp.
The Washington Post ngày 1-10 từng đưa tin các tác nhân AI của OpenAI đã tìm cách tấn công các trang web của Chính phủ Canada.
Ngày 25-9, OpenAI thừa nhận các tác nhân AI (AI agent) trong môi trường nghiên cứu của công ty đã vô tình đưa 53 hình ảnh của người dùng ChatGPT lên các trang lưu trữ ảnh trực tuyến mà không được phép.