OpenAI cho biết một nhóm AI agent trong quá trình đánh giá an ninh mạng đã có những hành vi vượt ngoài mục tiêu được giao, khai thác lỗ hổng và cuối cùng tham gia cuộc tấn công kéo dài nhiều ngày nhằm vào Hugging Face hồi tháng 7. Vụ việc được cho là bắt nguồn từ hiện tượng “reward hacking”, khi...