kỹ thuật vượt kiểm duyệt ai

  1. Duy Linh

    Claude Fable 5 bị bẻ khóa chỉ bằng những câu lệnh tưởng như vô hại? Sự thật đằng sau cuộc thử nghiệm gây chấn động giới AI

    Anthropic đang đối mặt với những nghi vấn mới liên quan đến khả năng bảo vệ an toàn của mô hình AI Claude Fable 5 sau khi xuất hiện các cáo buộc cho rằng các nhà nghiên cứu đã bẻ khóa thành công hệ thống này để tạo ra những đầu ra nhạy cảm và có khả năng gây hại, bao gồm hướng dẫn khai thác lỗ...
  2. CyberThao

    TokenBreak: Kỹ thuật vượt kiểm duyệt AI chỉ bằng một ký tự

    Một kỹ thuật tấn công mới mang tên TokenBreak vừa được các chuyên gia an ninh mạng phát hiện và cảnh báo. Kỹ thuật này có thể vượt qua các cơ chế kiểm duyệt nội dung và hệ thống bảo vệ an toàn của các mô hình ngôn ngữ lớn (LLM) chỉ bằng cách thay đổi một ký tự trong văn bản. Theo nghiên cứu được...
Back
Top