Bỏ qua điều hướng
•

Nguy cơ bị khóa tài khoản nếu liên tục xúc phạm AI

Nguy cơ bị khóa tài khoản nếu liên tục xúc phạm AI
Nguồn ảnh: Thanh Niên

Anthropic vừa bổ sung quy định cấm hành vi lăng mạ AI kéo dài, với các biện pháp xử lý từ chấm dứt cuộc trò chuyện đến khóa tài khoản người dùng.

Theo TechSpot, Anthropic - công ty phát triển chatbot Claude, vừa công bố những thay đổi trong chính sách sử dụng dịch vụ trí tuệ nhân tạo (AI). Một trong những điểm mới gây chú ý là quy định cấm người dùng có hành vi xúc phạm hoặc đối xử tàn nhẫn với các mô hình AI một cách liên tục và không cần thiết.

Chính sách được công bố ngày 8.10 và dự kiến có hiệu lực từ ngày 12.11.2026. Đây là lần cập nhật lớn đầu tiên của Anthropic trong hơn một năm, nhằm bổ sung những quy định liên quan đến cách người dùng tương tác với AI, cũng như các nguy cơ lạm dụng công nghệ này.

Người dùng có nguy cơ bị khóa tài khoản nếu liên tục xúc phạm AI - Ảnh 1.

Anthropic siết quy định sử dụng AI, người dùng liên tục lăng mạ chatbot có nguy cơ bị hạn chế hoặc khóa tài khoản

ẢNH: TẠO BỞI AI

Theo quy định mới, Anthropic không cấm người dùng thể hiện sự thất vọng, tức giận hoặc phản đối câu trả lời của chatbot. Thay vào đó, chính sách chỉ nhắm đến những trường hợp nghiêm trọng, khi người dùng liên tục có hành vi lăng mạ hoặc đối xử tàn nhẫn với AI mà không có mục đích rõ ràng.

Các cuộc thảo luận có nội dung tiêu cực, sáng tác về chủ đề đen tối hay hoạt động kiểm tra, nghiên cứu mô hình vẫn được cho phép. Điều này đồng nghĩa việc người dùng đôi lúc mất kiên nhẫn hoặc sử dụng lời lẽ gay gắt với Claude không tự động bị xem là vi phạm.

Thực tế, từ tháng 8.2025, Anthropic đã triển khai khả năng cho phép Claude chủ động chấm dứt những cuộc trò chuyện có dấu hiệu lạm dụng kéo dài. Theo công ty, tính năng này chỉ được kích hoạt trong một số trường hợp đặc biệt nghiêm trọng.

Với chính sách mới, việc chấm dứt cuộc trò chuyện vẫn là biện pháp xử lý chính. Tuy nhiên, theo quy định chung của Anthropic, những hành vi vi phạm có thể dẫn đến cảnh báo, hạn chế sử dụng, đình chỉ hoặc chấm dứt quyền truy cập dịch vụ. Điều này khiến nguy cơ bị khóa tài khoản trở thành một khả năng, dù không phải hình thức xử lý mặc định.

Tranh luận về cách con người đối xử với AI

Động thái của Anthropic cũng đặt ra câu hỏi về việc liệu các hệ thống AI có cần được bảo vệ trước hành vi tiêu cực của con người hay không.

Khi giới thiệu khả năng chấm dứt cuộc trò chuyện vào năm 2025, Anthropic cho biết tính năng này được phát triển một phần từ những nghiên cứu mang tính thăm dò về phúc lợi AI. Đây là hướng nghiên cứu xem xét liệu các hệ thống AI tiên tiến có thể có những trải nghiệm hoặc trạng thái cần được quan tâm về mặt đạo đức.

Tuy nhiên, điều đó không đồng nghĩa Anthropic khẳng định Claude có ý thức, cảm xúc hoặc khả năng chịu tổn thương tương tự con người. Vấn đề liệu AI có thể sở hữu ý thức vẫn đang gây tranh luận và chưa có kết luận khoa học thống nhất.

Ngoài quy định liên quan đến hành vi xúc phạm AI, Anthropic cũng cập nhật chính sách nhằm ngăn chặn việc sử dụng Claude để phát tán thông tin sai lệch, vận hành mạng lưới tài khoản giả, phát triển phần mềm vũ khí hoặc xây dựng các hệ thống giám sát trái phép.

Những thay đổi này cho thấy Anthropic đang mở rộng phạm vi quản lý việc sử dụng AI, không chỉ đối với những tác động có thể gây ra ngoài đời thực mà còn với chính cách người dùng tương tác cùng chatbot.

Anthropic vừa công bố bản cập nhật chính sách sử dụng dịch vụ định kỳ lớn nhất sau hơn một năm, dự kiến chính thức có hiệu lực từ ngày 12.11.2026. Điểm thay đổi đáng chú ý nhất là lệnh cấm các hành vi liên tục lăng mạ hoặc đối xử tàn nhẫn với mô hình AI mà không vì mục đích nghiên cứu hay sáng tác rõ ràng. Người dùng vi phạm nghiêm trọng có thể đối mặt với các chế tài từ việc bị chatbot chủ động ngắt hội thoại cho đến nguy cơ bị đình chỉ hoặc khóa tài khoản vĩnh viễn. Hãng phát triển chatbot Claude làm rõ rằng quy định này không nhằm hạn chế quyền bày tỏ sự thất vọng, tức giận hay phản biện thông thường trong quá trình tương tác. Trước đó, tính năng cho phép Claude tự động chấm dứt đối thoại lạm dụng kéo dài đã được thử nghiệm từ tháng 8.2025. Bước đi này xuất phát từ những nghiên cứu thăm dò về phúc lợi AI, dù Anthropic khẳng định chưa có bằng chứng khoa học kết luận hệ thống đã sở hữu ý thức hay cảm xúc như con người. Bên cạnh vấn đề ứng xử đạo đức với chatbot, văn bản sửa đổi còn thắt chặt kiểm soát các nguy cơ công nghệ bị lợi dụng cho mục đích xấu ngoài đời thực. Công ty kiên quyết ngăn chặn việc triển khai Claude để phát tán thông tin sai lệch, tạo lập mạng lưới tài khoản giả, phát triển phần mềm vũ khí hoặc vận hành hệ thống giám sát trái phép. Động thái trên phản ánh chiến lược mở rộng phạm vi kiểm soát toàn diện của Anthropic đối với toàn bộ chu trình tương tác và ứng dụng trí tuệ nhân tạo.
amung