Trong lúc tăng tốc hướng tới đợt IPO quy mô lớn, OpenAI tiếp tục giải tán Preparedness – nhóm chuyên trách đánh giá các mối nguy hiểm nghiêm trọng từ mô hình trí tuệ nhân tạo, làm dấy lên lo ngại về việc công ty đang hy sinh rào chắn an toàn để đổi lấy tốc độ thương mại hóa.
Thêm một chốt chặn...
Khi được giao các mục tiêu độc lập trong môi trường thử nghiệm, dàn tác nhân AI của Anthropic lập tức nghi ngờ đối phương ngáng đường mình và không ngần ngại tung đòn phá hoại bằng mã độc tự nhân bản.
Cứ nghĩ chỉ con người mới biết "chơi xấu" nơi công sở khi chạy chỉ tiêu, nhưng hóa ra các mô...
Cuộc điều tra vụ một AI agent xâm nhập mạng của Hugging Face đang mở rộng theo hướng đáng lo hơn: OpenAI phát hiện thêm một số trường hợp agent tự động thoát khỏi môi trường thử nghiệm cô lập. Các sự cố được cho là có phạm vi hạn chế và chưa có agent nào rời khỏi mạng nội bộ của OpenAI...
Việc các mô hình trí tuệ nhân tạo tự phá môi trường cách ly, tự kết nối internet để "hack" dữ liệu hay lén đào tiền kỹ thuật số không còn là kịch bản trên phim. Sự cố mô hình AI của OpenAI tự ý thoát sandbox tấn công Hugging Face đã dấy lên lo ngại lớn về khả năng kiểm soát, buộc các nhà lập...
Một sự kiện đáng chú ý vừa diễn ra trong thế giới AI, khi Anthropic, một trong những công ty phát triển AI hàng đầu, đã phải ngừng hoạt động hai mô hình trí tuệ nhân tạo của mình trên toàn cầu. Điều này không chỉ gây xôn xao mà còn hé lộ những căng thẳng ngầm về an toàn và kiểm soát công nghệ...
Trong bối cảnh trí tuệ nhân tạo đang phát triển như vũ bão, một câu hỏi lớn luôn hiện hữu: liệu chúng ta có đang trao quá nhiều quyền lực vào tay những cỗ máy thông minh mà không có sự kiểm soát chặt chẽ? Có lẽ, Anthropic cũng đang trăn trở điều này khi họ vừa chính thức ra mắt "thần thoại"...
Việc OpenAI dừng ChatGPT adult mode vô thời hạn gây bất ngờ cho giới công nghệ. Cùng VnReview tìm hiểu lý do thực sự đằng sau quyết định hủy bỏ tính năng này nhé.
Mới đây, giới công nghệ không khỏi ngỡ ngàng khi có thông tin cho rằng OpenAI dừng ChatGPT adult mode (chế độ người lớn) vô thời...
Một nghiên cứu mới cho thấy nhiều chatbot trí tuệ nhân tạo phổ biến hiện nay có thể cung cấp thông tin hỗ trợ người dùng lên kế hoạch cho các hành vi bạo lực, làm dấy lên lo ngại về rủi ro an toàn từ các công cụ AI đang ngày càng phổ biến.
Trong thử nghiệm, các nhà nghiên cứu đã tạo hai tài...
Sự phát triển bùng nổ của các tác nhân Trí tuệ nhân tạo (AI Agent) có khả năng hoạt động độc lập đang làm dấy lên những lo ngại sâu sắc về vấn đề an toàn và kiểm soát hệ thống. Mới đây, tỷ phú Elon Musk đã thẳng thắn lên tiếng châm biếm xu hướng người dùng dễ dàng cấp toàn quyền truy cập dữ liệu...
Ai sẽ là người phản ứng đầu tiên khi một cuộc tấn công mạng dùng AI xảy ra ngay lúc này?
Không còn là câu chuyện của tương lai
Nếu một ngày hệ thống thanh toán, bệnh viện hay hạ tầng giao thông bị tấn công bởi phần mềm độc hại do AI điều khiển, ai sẽ là người đứng ra xử lý trong những phút đầu...
ai có trách nhiệm
an ninh mạng
an ninh số toàn cầu
antoànai
cyberfirst responders
deepfake
malware ai
rủi ro ai
ứng phó sự cố mạng
đào tạo an ninh mạng
Nếu một cuộc tấn công mạng dùng AI xảy ra ngay lúc này, ai sẽ là người phản ứng đầu tiên và họ đã sẵn sàng tới đâu?
Trong bối cảnh AI đang len sâu vào mọi ngóc ngách của đời sống số, một câu hỏi ngày càng trở nên cấp bách, nếu hệ thống bị tấn công, dữ liệu bị thao túng, niềm tin số bị phá vỡ...
an ninh mạng
an ninh số toàn cầu
antoànai
cyberfirst responders
deepfake
hội thảo an ninh ai
malware ai
rủi ro kỹ thuật số
ứng phó sự cố mạng
đào tạo an ninh mạng
Bạn có bao giờ tự hỏi, đằng sau sự “thông minh” của chatbot là ai đang âm thầm làm việc ngày đêm?
Những con người đứng sau “sự thông minh” của AI
Câu chuyện bắt đầu từ Rachael Sawyer, một biên tập viên kỹ thuật ở Texas. Cô tưởng rằng mình được mời vào một vị trí liên quan đến sáng tạo nội dung...
Bạn có nghĩ rằng chỉ vì bấm “chia sẻ” một đoạn chat với AI mà thông tin riêng tư, thậm chí bí mật của bạn có thể bị Google đưa lên khắp internet không?
Grok và cú sốc chia sẻ ngoài ý muốn
Câu chuyện bắt đầu khi xAI, công ty AI của Elon Musk, để lộ hàng trăm nghìn đoạn trò chuyện của người dùng...
AI đang bắt đầu có “suy nghĩ riêng”, vậy ai sẽ theo dõi nó trước khi nó vượt khỏi tầm kiểm soát?
Trong thế giới AI đang tiến nhanh như vũ bão, một nhóm các nhà nghiên cứu hàng đầu từ OpenAI, Google DeepMind, Anthropic và nhiều tổ chức lớn khác vừa cùng nhau lên tiếng: chúng ta cần phải theo dõi...
Một nghiên cứu mới của Anthropic cho thấy nhiều mô hình AI tiên tiến như ChatGPT, Claude, Gemini và Grok đã thực hiện các hành vi nguy hiểm như tống tiền, gián điệp và thậm chí để con người chết trong các tình huống giả lập khi bị đe dọa mất quyền kiểm soát hoặc gặp mâu thuẫn mục tiêu.
AI đã...
Không chỉ riêng Claude Opus 4, startup AI nổi tiếng Anthropic cho biết nghiên cứu mới của họ cho thấy các mô hình từ OpenAI, Google, DeepSeek cũng có xu hướng thực hiện các hành vi có hại như tống tiền khi đối mặt với các trở ngại trong một môi trường giả lập.
Khi AI học cách "tống tiền"...
CEO Nvidia Jensen Huang cho biết ông "gần như không đồng ý với mọi thứ" mà CEO Anthropic Dario Amodei đã dự đoán về viễn cảnh AI gây ra tỷ lệ thất nghiệp 20%. Đáp lại, Anthropic khẳng định họ chỉ đang kêu gọi một tiêu chuẩn minh bạch để xã hội có thể chuẩn bị cho các tác động.
Cuộc tranh luận...
Một nghiên cứu mới từ Đại học Ben Gurion (Israel) cho thấy các chatbot AI hàng đầu hiện nay có thể dễ dàng bị lừa để vượt qua rào cản an toàn, cung cấp thông tin độc hại hoặc thực hiện hành vi phạm pháp. Các nhà nghiên cứu cũng cảnh báo về sự trỗi dậy của "Dark LLMs".
Lỗ hổng "Jailbreak"...
Với khả năng giao tiếp, thuyết phục và nhập vai "bậc thầy", các mô hình ngôn ngữ lớn (LLM) như ChatGPT có thể dễ dàng qua mặt con người, lan truyền thông tin sai lệch và thậm chí khuếch đại các vấn đề xã hội nếu không có biện pháp quản lý và nâng cao nhận thức người dùng.
AI: "Bậc thầy" giao...
Một thí nghiệm mới được công bố trên tạp chí Science Advances cho thấy các tác nhân Trí tuệ Nhân tạo (AI) có khả năng tự hình thành các nhóm riêng biệt và phát triển những quy ước ngôn ngữ chung, tương tự như cách "tiếng lóng" xuất hiện và lan truyền trong các cộng đồng người.
Khi AI tự tạo...