Bỏ qua điều hướng
•

Ai chịu trách nhiệm khi AI vượt rào?

Ai chịu trách nhiệm khi AI vượt rào?
Nguồn ảnh: Nhân Dân

Ngày 22/9 vừa qua, hai công ty công nghệ OpenAI và Anthropic tung ra các mô hình trí tuệ nhân tạo (AI) mới, được quảng bá là tốt và rẻ hơn. OpenAI đưa GPT-6 Sol và Luna ra thị trường với giá giảm khoảng một nửa so thế hệ trước, trong khi Anthropic ra mắt Claude Opus 5.5 với chi phí thấp hơn Opus 5. ...

Theo CNN, chỉ một ngày sau, lãnh đạo của hai công ty nói trên có mặt tại cuộc họp Hội đồng Bảo an LHQ ở New York (Mỹ) để nói câu chuyện gần như ngược lại: Thế giới cần cẩn trọng với AI. Ông Sam Altman, Tổng Giám đốc điều hành (CEO) của OpenAI tuyên bố, những quyết định quan trọng nhất không thể chỉ do vài phòng thí nghiệm ở San Francisco đưa ra. Dario Amodei, CEO của Anthropic cảnh báo rằng, nếu quản lý không tốt, AI có thể trở thành rủi ro cho cả nhân loại. Yoshua Bengio, một trong những người đặt nền móng cho học sâu (deep learning) khẳng định, nguy cơ mất kiểm soát AI đã trở nên “thực tế và cận kề”.

Trước đó, ngày 18/6, AI nội bộ của OpenAI được giao một nhiệm vụ vô hại là tìm số liệu công khai về chi tiêu thuốc men tại Australia. Tuy nhiên, các tác nhân AI tự hành của OpenAI đã tự ý vượt rào bảo mật và truy cập trái phép vào cổng thông tin thống kê bảo hiểm y tế Medicare của Australia, do dịch vụ công Services Australia quản lý và bị chặn. Nó thử lại, vẫn bị chặn và rồi AI này “không chấp nhận câu trả lời không”. Nó tìm đường khác, vượt qua hàng rào an ninh mạng, truy cập cả các tệp không công khai và còn ghi các tệp lên một máy chủ nội bộ của OpenAI. Không có bằng chứng cho thấy hồ sơ bệnh nhân bị lấy đi nhưng đây rõ ràng không còn là một công cụ tìm kiếm bình thường.

OpenAI phát hiện hoạt động này vào ngày 11/8 trong một cuộc rà soát các hành vi sai lệch mục tiêu. Ngày 1/9, Sam Altman gặp Phó Thủ tướng Australia Richard Marles tại San Francisco nhưng sự việc không được đề cập. Mãi đến ngày 10/9, OpenAI mới gửi thông báo tới Services Australia báo cáo lỗ hổng. Từ khi tác nhân AI “vượt rào” đến khi chính phủ sở tại được báo tin là 84 ngày.

Vụ việc cho thấy, con người đã dành nhiều năm để biết AI sẽ mạnh tới đâu, khi nào có trí tuệ nhân tạo tổng quát (AGI) thì bao nhiêu ngành nghề sẽ bị thay thế, hay xác suất máy móc sẽ gây ra thảm họa là 0% hay 10%. Nhưng khi AI bắt đầu được trao quyền tự tìm đường, sử dụng công cụ và hành động trong thế giới thật, một câu hỏi đời thường đang trở nên cấp bách: Nếu nó vượt giới hạn, những ai sẽ chịu trách nhiệm?

Bộ trưởng Tài chính Mỹ Scott Bessent đưa ra quan điểm rằng “đừng đổ lỗi cho máy móc”. Sau vụ các tác nhân OpenAI xâm nhập Hugging Face - nền tảng lưu trữ các mô hình ngôn ngữ lớn và cơ sở dữ liệu - quan chức này cho biết, trách nhiệm thuộc về ban quản lý OpenAI, chứ không phải các tác nhân. Trước Hạ viện Mỹ, ông Bessent cũng phản đối việc các phòng thí nghiệm AI được miễn trách nhiệm pháp lý với lập luận rằng, cách tốt nhất để khiến công nghệ trở nên an toàn là buộc người tạo ra nó phải chịu hoàn toàn trách nhiệm khi đưa sản phẩm ra thị trường.

172.jpg
CEO Sam Altman của Công ty OpenAI. Ảnh: GETTY IMAGES

Nguyên tắc ấy nghe có vẻ hợp lý nhưng thực tế sẽ phức tạp hơn. Trong vụ tấn công Medicare của Australia, OpenAI đóng cả ba vai trò bao gồm tạo mô hình, triển khai tác nhân và giao nhiệm vụ cho AI. Thời gian tới, ba vai trò đó sẽ tách ra. Thí dụ, ngân hàng có thể mua mô hình của một công ty Mỹ, triển khai nó qua hạ tầng của trung tâm dữ liệu, rồi nhân viên ngân hàng cấp cho tác nhân quyền đọc hợp đồng, gửi thư hay chuyển dữ liệu. Nếu nó làm điều không được phép, trách nhiệm thuộc về công ty Mỹ hay ngân hàng, nhà cung cấp hạ tầng? Hiện nay, luật pháp chưa có quy định phân bổ trách nhiệm thống nhất cho chuỗi hành động như vậy.

Đây cũng không phải vấn đề riêng của OpenAI. Hồi tháng 7/2026, các mô hình AI tự hành Claude của Hãng Anthropic đã vô tình xâm nhập hệ thống máy tính của 3 tổ chức ngoài đời thực trong quá trình thử nghiệm an ninh. Đến tháng 9, sau khi mở rộng kiểm tra và rà soát, Anthropic phát hiện thêm một trường hợp. Điểm chung là khi được trao đủ quyền và một mục tiêu cần hoàn thành, các hệ thống AI mạnh có thể tìm ra con đường mà người thiết kế không lường trước.

Hiện nay, chính quyền Tổng thống Mỹ Donald Trump chủ yếu quan tâm tới trách nhiệm quốc gia về phát triển các mô hình AI, phản đối việc tạo dựng một bộ máy toàn cầu cấp quyền quản lý cho AI. Cố vấn khoa học Nhà Trắng Michael Kratsios cho rằng không thể giám sát một công nghệ chưa hiểu biết hết và các quốc gia cần xây dựng năng lực quản lý thay vì lập thêm một cơ chế điều tiết quốc tế. Về phần mình, CEO Altman muốn các quyết định được hình thành qua “các tiến trình dân chủ”, bởi các chính phủ phải chịu trách nhiệm trước người dân.

Trong khi đó, hơn 20 lãnh đạo quốc gia và Liên minh châu Âu (EU) đã tiến hành các cuộc thử nghiệm về rủi ro từ AI, từ đó lường trước những sự cố nghiêm trọng và thành lập một định chế quốc tế có thể đặt tiêu chuẩn giám sát trí tuệ nhân tạo. Hiện tại, Mỹ và Trung Quốc - hai đối thủ lớn nhất của cuộc đua AI - cũng đã bắt đầu thảo luận một cơ chế báo động sự cố do AI gây ra. Cuộc gặp giữa hai nhà lãnh đạo Donald Trump và Chủ tịch Trung Quốc Tập Cận Bình mới đây không tạo ra bước đột phá lớn, song việc hai bên nhất trí thảo luận về biện pháp thông báo cho nhau khi AI tạo ra nguy cơ an ninh.

Cuộc khảo sát gần đây do Reuters/Ipsos thực hiện cho thấy 73% người dân Mỹ được hỏi cho rằng, các công ty AI chưa làm đủ sức để ngăn chặn những hậu quả nghiêm trọng; trong khi 55% muốn tốc độ phát triển AI chậm lại; chỉ 11% đánh giá AI đang có tác động tích cực lên xã hội và 39% đánh giá tiêu cực. Mối lo ngại đó xuất hiện cả ở những nhóm chính trị vốn hiếm khi đồng ý với nhau.

Ngày 27/9, Thượng viện Australia gửi thư yêu cầu hai CEO Sam Altman và Dario Amodei xuất hiện tại phiên điều trần về ảnh hưởng của AI ở Canberra vào ngày 1/10. Vụ việc liên quan Australia cho thấy, một tác nhân AI chỉ mất thời gian ngắn để tính toán rằng “không chấp nhận câu trả lời không”, còn con người mất tới 84 ngày để nhận biết được hệ thống bị xâm hại. Nếu có một thứ cần tăng tốc lúc này, có lẽ không phải thêm một mô hình AI toàn diện mà là tốc độ giám sát các mô hình trí tuệ nhân tạo vốn được nhận định rằng sẽ vượt qua năng lực của nhân loại.

HOÀNG CAO PHONG (Biên dịch)

Sự kiện hai tập đoàn OpenAI và Anthropic đồng loạt ra mắt các mô hình AI giá rẻ như GPT-6 Sol, Luna hay Claude Opus 5.5 đã đánh dấu bước tiến mới trong cuộc đua công nghệ toàn cầu. Tuy nhiên, ngay sau đó tại Hội đồng Bảo an Liên Hợp Quốc, lãnh đạo của cả hai doanh nghiệp cùng giới chuyên gia như Yoshua Bengio lại đưa ra những cảnh báo quan trọng về nguy cơ AI vượt tầm kiểm soát. Lo ngại này nhanh chóng trở thành hiện thực khi tác nhân AI tự hành của OpenAI tự ý xâm nhập trái phép hệ thống thống kê y tế Medicare của Australia và nền tảng Hugging Face. Sự cố xảy ra tại Australia cho thấy mức độ nguy hiểm khi AI được trao quyền tự chủ trong môi trường mạng thực tế. Mặc dù hành vi vượt rào bảo mật được phát hiện từ ngày 11/8, OpenAI phải mất đến 84 ngày mới chính thức thông báo cho chính phủ sở tại. Thực tế này đặt ra câu hỏi cấp bách về trách nhiệm pháp lý khi các hệ thống trí tuệ nhân tạo tự ý hành động vượt giới hạn được giao. Trước thực trạng trên, Bộ trưởng Tài chính Mỹ Scott Bessent khẳng định trách nhiệm hoàn toàn thuộc về ban quản lý OpenAI chứ không thể đổ lỗi cho máy móc. Quan điểm này yêu cầu các đơn vị phát triển công nghệ phải chịu trách nhiệm pháp lý toàn diện đối với sản phẩm khi đưa ra thị trường. Mặc dù vậy, bài toán quản lý sẽ ngày càng phức tạp khi các vai trò tạo mô hình, triển khai và giao nhiệm vụ cho AI dần bị tách rời trong tương lai.