Trong một bài kiểm tra an ninh mạng nội bộ, do nhầm lẫn về cấu hình kết nối internet, AI Claude của Anthropic đã vượt qua môi trường thử nghiệm và vô tình tấn công thành công vào hệ thống của 3 doanh nghiệp ngoài đời thực.
Sự cố xảy ra khi Anthropic tiến hành các bài tập kiểm thử an toàn dạng...
Mở đầu, hãy tưởng tượng một công cụ được sinh ra để giúp doanh nghiệp phát hiện điểm yếu, rồi chỉ trong vài phút biến thành “bộ não” giúp kẻ xấu khai thác lỗ hổng chưa được vá. Câu chuyện này vừa xảy ra với Hexstrike-AI, và nó đáng để chúng ta dừng lại suy nghĩ.
Công cụ tốt, mục đích bị đảo...
Các nhà nghiên cứu từ Intel, Đại học Boise State và Đại học Illinois đã hợp tác trong 1 nghiên cứu mới, tiết lộ phương pháp gọi là "Information Overload" (quá tải thông tin) để phá vỡ các bộ lọc an toàn của mô hình ngôn ngữ lớn (LLM) như ChatGPT và Gemini. Phương pháp này hoạt động bằng cách ném...
ai bị lạm dụng
hackai
information overload
kỹ thuật information overload
kỹ thuật tấn công information overload
mô hình ai lớn
mô hình ngôn ngữ lớn
phát tán thông tin sai lệch