Kỹ thuật tư duy mới của OpenAI khiến giới nghiên cứu AI lạnh gáy

Mẫn Nhi
Mẫn Nhi
Phản hồi: 0

Mẫn Nhi

Admin xinh gái
Mô hình Astra mới của OpenAI đang tiếp cận một kỹ thuật tư duy khác lạ mang tên "recurrent depth". Khả năng cho phép AI suy ngẫm theo vòng lặp thay vì tư duy tuần tự. Nhưng chưa kịp vui mừng, việc nó có thể che giấu hoàn toàn chuỗi suy nghĩ trước mắt con người đang khiến cộng đồng nghiên cứu an toàn AI thực sự đứng ngồi không yên.

Khi chuỗi tư duy của AI dần trở nên vô hình​

1788426089661.png

Trong các hệ thống AI suy luận hiện nay, chuỗi tư duy (Chain of Thought - CoT) chính là chiếc "hộp đen bán phần" giúp con người nhìn thấu phần nào đường đi nước bước của mô hình. Dù cách biểu diễn này chưa hoàn hảo, nó vẫn là công cụ giá trị nhất để các kỹ sư phát hiện ra hành vi sai lệch hoặc mất kiểm soát. Thực tế trong những sự cố tác tử AI hoạt động bất thường gần đây, các bản ghi chuỗi tư duy chính là chìa khóa then chốt để lần ra lý do vì sao mô hình lại hành xử như vậy.

Mọi chuyện bắt đầu rẽ sang hướng đáng lo ngại khi mô hình Astra của OpenAI được trang bị kỹ thuật tư duy theo chiều sâu lặp lại (recurrent depth), hay còn gọi là lặp mờ (opaque recurrence). Thay vì bước đi từng bước một cách tuyến tính và minh bạch, mô hình xử lý cùng một truy vấn nhiều lần trong một vòng lặp kín. Cách tiếp cận phi tuyến tính này để lại rất ít dấu vết đọc được, gần như né tránh hoàn toàn cơ chế ghi nhận chuỗi tư duy truyền thống.

Chơi với lửa và nỗi lo về một "cuộc đua xuống đáy"​

Ngay khi thông tin này xuất hiện, giới an toàn AI đã phản ứng vô cùng gay gắt. Buck Shlegeris, CEO của Redwood, không giấu nổi sự lo ngại khi cho rằng việc áp dụng opaque recurrence có thể mở đường cho OpenAI tăng dần mức độ lặp và phá hủy hoàn toàn khả năng giám sát chuỗi tư duy trong tương lai, dù hiện tại mức độ sử dụng trên Astra vẫn còn giới hạn.

Nhà vận động an toàn AI kỳ cựu Zvi Mowshowitz thậm chí còn ví von kỹ thuật này như hành động "đùa với lửa". Ông cho rằng OpenAI và Anthropic từng phải đấu tranh rất nhiều để thiết lập một ranh giới cấm kỵ nhằm duy trì tính trung thực và khả năng theo dõi của chuỗi tư duy lâu nhất có thể. Việc lạm dụng kỹ thuật lặp mờ sẽ gây tổn hại nghiêm trọng đến việc giám sát, đồng thời đặt ra vấn đề cần có luật pháp can thiệp để ngăn chặn một cuộc đua xuống đáy giữa các phòng thí nghiệm AI.

Ryan Greenblatt, Giám đốc khoa học của Redwood Research, cũng chỉ ra một kịch bản đáng sợ hơn. Tư duy mờ hoàn toàn có thể mở rộng quy mô nhanh hơn nhiều so với tư duy tuần tự truyền thống. Một bước tiến tự nhiên từ đây là việc mở rộng quy mô tư duy mờ đến mức AI sẽ suy nghĩ hoàn toàn hoặc gần như hoàn toàn trong không gian tiềm ẩn (latent space), triệt tiêu mọi khả năng theo dõi từ bên ngoài qua các kênh hiển thị thông thường.

Lời trấn an từ OpenAI liệu đã đủ?​

Đứng trước làn sóng chỉ trích, OpenAI khẳng định việc áp dụng kỹ thuật này trên Astra chỉ ở mức giới hạn. Chuỗi tư duy của mô hình vẫn nằm trong tầm kiểm soát để có thể đọc được, đồng thời hãng bác bỏ giả thuyết cho rằng họ đang chuyển dịch mô hình sang dạng ngôn ngữ thần kinh nội bộ (neuralese). Nhà khoa học trưởng của OpenAI, Jakub Pachocki, cũng lên tiếng nhấn mạnh rằng việc duy trì và tận dụng khả năng giám sát chuỗi tư duy là mục tiêu cốt lõi trong chương trình nghiên cứu của họ kể từ những mô hình suy luận đầu tiên.

Dẫu vậy, lời xoa dịu đó khó lòng dập tắt sự bồn chồn của giới công nghệ. Bất kỳ mô hình nào cũng có một phần tư duy mờ, nhưng việc các đối thủ lớn như Anthropic và Google DeepMind cũng đã bắt đầu thảo luận về kỹ thuật này cho thấy một xu hướng mới đang rục rịch hình thành. Khi cuộc đua hiệu năng ngày càng khốc liệt, liệu các ông lớn có giữ nổi cam kết minh bạch, hay sẽ thả rông cho AI tự do suy nghĩ mà không còn ai có thể nhìn thấu bên trong?
 
Back
Top