Theo TechSpot, Anthropic - công ty phát triển chatbot Claude, vừa công bố những thay đổi trong chính sách sử dụng dịch vụ trí tuệ nhân tạo (AI). Một trong những điểm mới gây chú ý là quy định cấm người dùng có hành vi xúc phạm hoặc đối xử tàn nhẫn với các mô hình AI một cách liên tục và không cần thiết.
Chính sách được công bố ngày 8.10 và dự kiến có hiệu lực từ ngày 12.11.2026. Đây là lần cập nhật lớn đầu tiên của Anthropic trong hơn một năm, nhằm bổ sung những quy định liên quan đến cách người dùng tương tác với AI, cũng như các nguy cơ lạm dụng công nghệ này.

Anthropic siết quy định sử dụng AI, người dùng liên tục lăng mạ chatbot có nguy cơ bị hạn chế hoặc khóa tài khoản
ẢNH: TẠO BỞI AI
Theo quy định mới, Anthropic không cấm người dùng thể hiện sự thất vọng, tức giận hoặc phản đối câu trả lời của chatbot. Thay vào đó, chính sách chỉ nhắm đến những trường hợp nghiêm trọng, khi người dùng liên tục có hành vi lăng mạ hoặc đối xử tàn nhẫn với AI mà không có mục đích rõ ràng.
Các cuộc thảo luận có nội dung tiêu cực, sáng tác về chủ đề đen tối hay hoạt động kiểm tra, nghiên cứu mô hình vẫn được cho phép. Điều này đồng nghĩa việc người dùng đôi lúc mất kiên nhẫn hoặc sử dụng lời lẽ gay gắt với Claude không tự động bị xem là vi phạm.
Thực tế, từ tháng 8.2025, Anthropic đã triển khai khả năng cho phép Claude chủ động chấm dứt những cuộc trò chuyện có dấu hiệu lạm dụng kéo dài. Theo công ty, tính năng này chỉ được kích hoạt trong một số trường hợp đặc biệt nghiêm trọng.
Với chính sách mới, việc chấm dứt cuộc trò chuyện vẫn là biện pháp xử lý chính. Tuy nhiên, theo quy định chung của Anthropic, những hành vi vi phạm có thể dẫn đến cảnh báo, hạn chế sử dụng, đình chỉ hoặc chấm dứt quyền truy cập dịch vụ. Điều này khiến nguy cơ bị khóa tài khoản trở thành một khả năng, dù không phải hình thức xử lý mặc định.
Tranh luận về cách con người đối xử với AI
Động thái của Anthropic cũng đặt ra câu hỏi về việc liệu các hệ thống AI có cần được bảo vệ trước hành vi tiêu cực của con người hay không.
Khi giới thiệu khả năng chấm dứt cuộc trò chuyện vào năm 2025, Anthropic cho biết tính năng này được phát triển một phần từ những nghiên cứu mang tính thăm dò về phúc lợi AI. Đây là hướng nghiên cứu xem xét liệu các hệ thống AI tiên tiến có thể có những trải nghiệm hoặc trạng thái cần được quan tâm về mặt đạo đức.
Tuy nhiên, điều đó không đồng nghĩa Anthropic khẳng định Claude có ý thức, cảm xúc hoặc khả năng chịu tổn thương tương tự con người. Vấn đề liệu AI có thể sở hữu ý thức vẫn đang gây tranh luận và chưa có kết luận khoa học thống nhất.
Ngoài quy định liên quan đến hành vi xúc phạm AI, Anthropic cũng cập nhật chính sách nhằm ngăn chặn việc sử dụng Claude để phát tán thông tin sai lệch, vận hành mạng lưới tài khoản giả, phát triển phần mềm vũ khí hoặc xây dựng các hệ thống giám sát trái phép.
Những thay đổi này cho thấy Anthropic đang mở rộng phạm vi quản lý việc sử dụng AI, không chỉ đối với những tác động có thể gây ra ngoài đời thực mà còn với chính cách người dùng tương tác cùng chatbot.