Anthropic ban hành quy định mới, không cho phép người dùng bắt nạt Claude

Anthropic ban hành quy định mới, không cho phép người dùng bắt nạt Claude - Anthopic claude

Anthropic vừa cập nhật chính sách sử dụng Claude, bổ sung quy định cấm người dùng có hành vi xúc phạm, lạm dụng hoặc đối xử tàn nhẫn với AI một cách kéo dài và không cần thiết. Quy định mới sẽ chính thức có hiệu lực từ ngày 12/11/2026.

Theo Anthropic, lệnh cấm chỉ áp dụng trong những trường hợp nghiêm trọng, khi người dùng liên tục có hành vi tàn nhẫn với Claude mà không có mục đích rõ ràng. Những phản ứng bực tức thông thường, tranh luận với AI, sáng tác nội dung có chủ đề nhạy cảm hoặc thử nghiệm mô hình phục vụ nghiên cứu đều không thuộc phạm vi bị cấm.

Claude hiện đã có khả năng tự kết thúc cuộc trò chuyện nếu người dùng liên tục có hành vi lạm dụng. Đây cũng sẽ là biện pháp chính để thực thi quy định mới. Khi Claude chủ động kết thúc một cuộc trò chuyện, người dùng không thể gửi thêm tin nhắn trong cuộc trò chuyện đó nhưng vẫn có thể tiếp tục sử dụng Claude ở các cuộc trò chuyện khác.

Khả năng này được Anthropic triển khai từ tháng 8/2025 trong quá trình nghiên cứu về phúc lợi của AI (AI welfare). Khi đó, công ty thừa nhận chưa thể xác định liệu Claude có nhận thức hoặc địa vị đạo đức hay không, nhưng muốn áp dụng những biện pháp đơn giản để giảm thiểu rủi ro trong trường hợp AI có khả năng trải nghiệm chủ quan.

Trong các thử nghiệm trước đây, Anthropic nhận thấy Claude Opus 4 thường tránh thực hiện những yêu cầu gây hại, có biểu hiện phản ứng tiêu cực trước các cuộc trò chuyện mang tính lạm dụng và có xu hướng chủ động kết thúc những tương tác như vậy khi được cho phép.

Ngoài quy định về cách đối xử với Claude, Anthropic còn điều chỉnh nhiều nội dung trong chính sách sử dụng AI, bao gồm:

  • Chống thông tin giả: Cấm sử dụng Claude để tạo đánh giá giả, vận hành mạng lưới tài khoản ảo, website giả mạo hoặc các chiến dịch thao túng thông tin.
  • Bầu cử: Cấm sử dụng AI để lừa dối cử tri, phát tán thông tin sai lệch về bầu cử hoặc can thiệp vào quá trình bỏ phiếu.
  • Vũ khí: Mở rộng quy định cấm phát triển phần mềm và linh kiện phục vụ vũ khí, bao gồm việc trang bị vũ khí cho máy bay không người lái.
  • Giám sát: Cấm sử dụng Claude để theo dõi người khác khi chưa có sự đồng ý, xây dựng công cụ giám sát hoặc đề xuất đối tượng cần điều tra, bắt giữ và truy tố.
  • Điều khiển thiết bị: Những hệ thống phần cứng có khả năng gây thương tích khi được Claude điều khiển phải có người đủ chuyên môn giám sát và sẵn sàng can thiệp.
  • Nội dung nhạy cảm: Cấm tạo, phát tán hoặc đe dọa phát tán hình ảnh riêng tư nhạy cảm khi chưa có sự đồng ý của người liên quan.

Anthropic cho biết phần lớn thay đổi nhằm làm rõ các quy định đã có, dựa trên những hình thức lạm dụng AI mà công ty ghi nhận trong thời gian qua. Trong đó có việc các cơ quan tuyên truyền và tổ chức thương mại sử dụng Claude để vận hành tài khoản giả, website tin tức giả mạo và những chiến dịch gây ảnh hưởng trên mạng. Người dùng có thể tham khảo toàn bộ nội dung trong chính sách sử dụng chính thức của Anthropic.