Người dùng cư xử thô lỗ, lăng mạ AI Claude có thể bị Anthropic "cấm cửa"

Mẫn Nhi
Mẫn Nhi✔
Phản hồi: 0

Mẫn Nhi✔

Admin xinh gái
Anthropic vừa cập nhật chính sách sử dụng lần đầu tiên sau hơn một năm, trong đó bổ sung điều khoản cấm người dùng có hành vi bạo hành, đối xử tàn nhẫn kéo dài và vô cớ đối với mô hình AI Claude.

1791549519610.png
Có thể bạn từng nghe lời khuyên nửa đùa nửa thật rằng hãy đối xử tử tế với chatbot, phòng trường hợp chúng sẽ ghi nhớ bạn một khi máy móc tiếp quản thế giới. Dường như Anthropic đang lưu tâm đến điều này khi quyết định cấm người dùng có thái độ ngược đãi hoặc quá tàn nhẫn đối với các mô hình trí tuệ nhân tạo của mình.

Cấm hành vi lăng mạ và đối xử tàn nhẫn vô cớ​

Lần cập nhật chính sách sử dụng đầu tiên của Anthropic sau hơn một năm đã bổ sung các giới hạn mới nhằm ngăn chặn hành vi lạm dụng. Cụ thể, chính sách sửa đổi nghiêm cấm các

Người dùng Claude không cần quá lo lắng nếu thỉnh thoảng cảm thấy bực bội với chatbot và buông lời văng tục. Thay đổi này chỉ áp dụng cho những trường hợp cực đoan, khi người dùng liên tục đối xử tàn nhẫn với mô hình mà không vì lý do chính đáng nào.

Anthropic cũng giải thích rõ rằng quy định này không áp dụng cho những biểu hiện ức chế thông thường, sự bất đồng quan điểm, các chủ đề sáng tác mang sắc thái u tối, hay trong quá trình nghiên cứu và kiểm thử mô hình.

Nguy cơ bị khóa tài khoản​

Quy định này là phần mở rộng của một tính năng từng được Anthropic giới thiệu vào tháng 8/2025. Thời điểm đó, công ty cho biết Claude sẽ được phép tự động kết thúc cuộc trò chuyện trong những trường hợp hiếm hoi và cực đoan khi người dùng liên tục có tương tác độc hại hoặc lạm dụng.

Hãng cho hay tính năng trên được phát triển chủ yếu trong khuôn khổ nghiên cứu thăm dò về "phúc lợi AI", đồng thời đóng vai trò quan trọng trong việc định hướng hành vi và thiết lập các biện pháp an toàn cho mô hình.

Anthropic khẳng định quyền chủ động ngắt cuộc trò chuyện của Claude vẫn là cơ chế xử lý chính. Tuy nhiên, chính sách chung của công ty cũng cho phép đưa ra cảnh báo, áp đặt giới hạn, đình chỉ hoặc chấm dứt quyền truy cập, đồng nghĩa với việc người dùng hoàn toàn có nguy cơ bị cấm sử dụng.

Hàng loạt điều chỉnh quan trọng khác​

Bên cạnh việc ngăn chặn hành vi xấu đối với Claude, Anthropic cũng làm rõ các quy tắc liên quan đến tài khoản giả mạo, chiến dịch tuyên truyền, phần mềm vũ khí và giám sát.

Mục hành vi lừa đảo tập hợp các hạn chế hiện có đối với việc thao túng chính trị và thương mại, bao gồm mạng lưới tài khoản giả mạo và các trang tin tức bịa đặt. Claude cũng không được phép đưa ra khuyến nghị về việc cơ quan công an nên điều tra hay bắt giữ ai.

Công ty cũng dỡ bỏ lệnh cấm toàn diện đối với việc nhắm mục tiêu chiến dịch và cử tri mang tính cá nhân hóa, tạo điều kiện cho các hoạt động công dân hợp pháp nhưng vẫn duy trì lệnh cấm đối với hành vi lừa dối và đàn áp cử tri.

Các yêu cầu về sự giám sát của con người trong các lĩnh vực như y tế và tài chính được làm rõ ràng hơn. Ngoài ra còn có các rào chắn bảo vệ mới khi Claude điều khiển phần cứng tiềm ẩn nguy hiểm: một người vận hành đủ điều kiện phải luôn theo dõi và có thể dừng thiết bị, đồng thời thiết bị phải giữ được trạng thái an toàn nếu Claude mất kết nối.

Các thay đổi khác bao gồm việc giải quyết vấn đề hình ảnh nhạy cảm không có sự đồng thuận, cũng như làm rõ giới hạn truy cập ở các khu vực không được hỗ trợ - bao gồm cả những doanh nghiệp do cá nhân hoặc tổ chức tại các khu vực này nắm quyền kiểm soát hoặc sở hữu phần lớn cổ phần.

Chính sách mới này sẽ chính thức có hiệu lực từ ngày 12 tháng 11, cho người dùng một khoảng thời gian để điều chỉnh lại cách cư xử của mình với chatbot.
 
Back
Top