Microsoft bị quá tải mã lập trình AI, không thể theo kịp việc sửa lỗi hoặc phê duyệt các plugin

Hoàng Đức
Hoàng Đức
Phản hồi: 0
Trong những năm gần đây, Microsoft liên tục nói về trí tuệ nhân tạo: trợ lý lập trình, AI tìm lỗi và sử dụng tự động hóa để nâng cao hiệu quả. Nhưng hai bài đăng gần đây trên blog của Microsoft lại đi theo hướng khác: thay vì ca ngợi "AI thật tuyệt vời", họ lại cho rằng "Có quá nhiều AI, và chúng ta không thể theo kịp". Một mặt, nhóm Exchange cho rằng AI đang tìm lỗi quá mạnh tay, dẫn đến việc không có đủ thời gian để phát hành các bản cập nhật tích lũy; mặt khác, nhóm Edge thừa nhận rằng có quá nhiều tiện ích mở rộng trình duyệt do AI tạo ra đến nỗi họ đơn giản là không thể xem xét hết tất cả. Chỉ trong chưa đầy một tháng, Microsoft đã hai lần tự phơi bày những sai sót của mình, và thủ phạm chính là AI.

Câu chuyện bắt đầu vào ngày 13 tháng 8, khi nhóm Microsoft Exchange phát hành một tài liệu có tiêu đề "CU1 ở đâu vậy?", thừa nhận việc nhận được nhiều câu hỏi từ khách hàng về thời điểm phát hành bản cập nhật tích lũy CU1 cho Exchange Server Subscription Edition (Exchange SE). Câu hỏi này được hỏi đi hỏi lại nhiều lần vì Microsoft ban đầu hứa sẽ phát hành trước cuối nửa đầu năm 2026, sau đó âm thầm thay đổi thành nửa cuối năm 2026, rồi ngừng đưa ra ngày cụ thể. Exchange SE là phiên bản trả phí của máy chủ thư điện tử Microsoft, trong khi Bản cập nhật tích lũy (CU) là bản cập nhật đóng gói bao gồm tất cả các bản sửa lỗi gần đây, các tính năng mới và việc loại bỏ mã lỗi thời. Microsoft phát hành CU một hoặc hai lần mỗi năm, và một số người dùng thích cài đặt trực tiếp CU hơn là vá từng bản cập nhật riêng lẻ.
1789465056929.png
Lý do Microsoft đưa ra cho sự chậm trễ trong việc phát hành bản cập nhật CU có phần bất ngờ: các công cụ AI đã phát hiện ra quá nhiều lỗi. Trong vài tháng qua, Microsoft đã sử dụng nhiều công cụ AI khác nhau để tìm lỗi trong các sản phẩm của mình. Nhưng việc tìm ra lỗi không phải là kết thúc; thay vào đó, nó báo hiệu một loạt các nhiệm vụ dài sắp bắt đầu: các kỹ sư cần xác nhận xem lỗi đó có thực sự tồn tại hay không trước khi cố gắng tái tạo nó; sau khi xác nhận, họ cần sửa đổi mã, kiểm tra hiệu quả của bản sửa lỗi và thực hiện kiểm thử hồi quy để đảm bảo rằng "sửa một lỗi không vô tình tạo ra ba lỗi mới"; và sau đó, họ cần đóng gói các bản sửa lỗi này vào một bản cập nhật bảo mật và phát hành nó. Tuy nhiên, các lỗi bảo mật không chờ đến lượt để kỹ sư sửa chữa; các lỗi mới liên tục xuất hiện và các bản cập nhật bảo mật cần được phát hành hàng tháng. Nhóm Exchange đã rơi vào tình huống khá khó xử: vừa sửa các lỗi bảo mật mới, vừa đồng thời làm việc trên bản cập nhật CU1.

Điều đáng lo ngại hơn nữa là Microsoft đang lưỡng lự trong việc phát hành CU1. Nếu một lỗi bảo mật nghiêm trọng xuất hiện ngay sau khi CU1 được phát hành, các quản trị viên doanh nghiệp có thể sẽ phải cài đặt một bản cập nhật lớn khác ngay lập tức, vì vậy Microsoft muốn chờ đợi. Nhóm Exchange cho biết họ sẽ tiếp tục tích hợp các bản cập nhật bảo mật hàng tháng vào phiên bản nội bộ CU1 và sẽ chính thức phát hành CU1 khi phiên bản này đủ ổn định và không có "bản cập nhật bảo mật khẩn cấp cần được ưu tiên" trong tháng đó. Nghe có vẻ rất an toàn, câu hỏi duy nhất là: đến tháng nào sẽ không còn bản cập nhật bảo mật khẩn cấp nào nữa? Bài đăng trên blog kết luận: "Tóm lại, Exchange SE CU1 chắc chắn sẽ được phát hành; chúng tôi chưa quên, nhưng chưa thể đưa ra ngày cụ thể." Tuyên bố này nghe có vẻ đáng tin cậy, nhưng hầu như không chứa bất kỳ thông tin nào.

Trước khi chúng tôi kịp hồi phục, Edge lại bị AI áp đảo một lần nữa. Vấn đề liên quan đến Exchange vẫn chưa kết thúc, và giờ đây nhóm Edge ở bên cạnh cũng đang gặp rắc rối. Vào ngày 8 tháng 9, nhóm Microsoft Edge đã thừa nhận trong một bài đăng trên blog rằng họ cũng cảm thấy choáng ngợp trước trí tuệ nhân tạo. Bài đăng nêu rõ: "Với sự phát triển nhanh chóng của lập trình hỗ trợ AI, các nhà phát triển giờ đây có thể xây dựng các tiện ích mở rộng trình duyệt nhanh hơn bao giờ hết." Trước đây, việc phát triển một plugin trình duyệt đòi hỏi phải viết mã, gỡ lỗi, kiểm thử và chỉnh sửa từng chút một. Giờ thì khác: với các công cụ AI, các nhà phát triển có thể sử dụng mô hình để tạo mã, sau đó liên tục sửa đổi và cải tiến để nhanh chóng tạo ra một số lượng lớn các công cụ nhỏ mà họ chưa từng thử trước đây. Kết quả là, hệ sinh thái tiện ích mở rộng của Edge đã gặp phải một tác dụng phụ mà Microsoft có thể không lường trước được: số lượng đóng góp bắt đầu tăng vọt.

Tuy nhiên, plugin vẫn phải được đưa vào Edge Add-ons. Trước khi gửi các tiện ích mở rộng lên cửa hàng, Microsoft không thể chỉ đơn giản "tải lên ngay khi chúng được viết xong". Các tiện ích mở rộng phải trải qua quá trình xem xét để kiểm tra xem có vi phạm chính sách nền tảng, vấn đề bảo mật và tuân thủ các yêu cầu chất lượng liên quan hay không. Bản thân Microsoft cũng thừa nhận rằng "quy trình xem xét nhanh dành cho các tiện ích mở rộng chất lượng cao, giá trị cao" mà họ đã triển khai trước đây hiện đang phải đối mặt với áp lực mới. Nói một cách đơn giản: trí tuệ nhân tạo phía nhà phát triển đang ngày càng đẩy mạnh quá trình này, số lượng plugin được gửi đến liên tục tăng lên, gánh nặng cho quy trình xem xét của Microsoft ngày càng lớn, và cuối cùng, thời gian xử lý các đánh giá mở rộng ngày càng kéo dài.

Đối mặt với thách thức này, Microsoft đã không lựa chọn biện pháp quyết liệt là mở rộng việc xem xét thủ công. Thay vào đó, họ tiếp tục tích hợp trí tuệ nhân tạo vào quy trình xem xét. Nhóm Edge cho biết họ đã tự động hóa nhiều bước kiểm tra xác minh lặp đi lặp lại trong quy trình xem xét và đơn giản hóa quy trình làm việc. Microsoft nhấn mạnh rằng điều này không có nghĩa là hạ thấp tiêu chuẩn xem xét hoặc giảm số lượng kiểm tra cần thiết; nó chỉ đơn giản là chia nhỏ quy trình xem xét: AI xử lý các "câu trả lời tiêu chuẩn", trong khi con người xử lý các trường hợp phức tạp hơn cần đến sự đánh giá. Microsoft chưa nêu rõ chính xác lượng AI được sử dụng trong các quy trình tự động hóa này, nhưng logic khá rõ ràng: vì AI giúp tăng tốc quá trình sản xuất ban đầu, nên quá trình xem xét tiếp theo cũng cần được tự động hóa, nếu không toàn bộ hệ thống cuối cùng sẽ bị tắc nghẽn.

Chỉ trong vòng chưa đầy một tháng, hai nhóm của Microsoft đã liên tiếp gặp phải những khó khăn tương tự. Với Exchange, để AI tìm lỗi dẫn đến số lượng lỗi tăng lên, kỹ sư phải xác minh, sửa chữa và kiểm tra, các bản cập nhật bảo mật liên tục được ưu tiên, và bản cập nhật tích lũy CU1 không thể được phát hành trong thời gian dài. Với Edge, cho phép mã được tạo bởi AI giúp các nhà phát triển tạo plugin nhanh hơn, số lượng bài nộp tăng lên, áp lực lên việc xem xét thủ công tăng vọt, và chu kỳ xem xét trở nên dài hơn. Các nhà phát triển có thể tạo ra 10 plugin cùng một lúc, nhưng các nhóm đánh giá không thể đánh giá 10 plugin cùng một lúc; AI có thể tìm ra hàng loạt lỗ hổng cùng một lúc, nhưng các kỹ sư bảo mật vẫn phải xác nhận, tái tạo và sửa chữa chúng từng cái một. Mặc dù một bên bị mắc kẹt trong quá trình phát hành và bên kia bị mắc kẹt trong quá trình đánh giá, chúng có một điểm chung: AI đã thúc đẩy hiệu quả sản xuất ở khâu đầu nguồn, nhưng khâu cuối nguồn thì không được tăng tốc tương ứng.

Đây thực chất cũng là một vấn đề của lập trình AI. Khi mọi việc diễn biến đến thời điểm này, một sự thay đổi ngày càng đáng chú ý đã xuất hiện. Trước đây, vấn đề đau đầu lớn nhất của lập trình viên có lẽ là "không thể viết đủ mã". Nhưng khi việc tạo mã chuyển từ "lập trình viên có thể viết bao nhiêu trong một ngày" sang "một tác nhân có thể viết bao nhiêu trong vài giờ", các vấn đề trở nên phức tạp hơn: Ai sẽ kiểm thử tất cả mã này? Ai sẽ sửa lỗi khi chúng được tìm thấy? Ai sẽ xem xét các plugin sau khi chúng được viết xong? Ai sẽ xác minh chúng sau khi chúng được sửa chữa? Và ai sẽ chịu trách nhiệm nếu có vấn đề phát sinh sau khi triển khai? Tóm lại, mặc dù AI giúp việc viết mã dễ dàng hơn, nhưng nó không làm cho mã an toàn hơn - đây là hai điều khác nhau. Hiện tại, AI chưa thể tự động loại bỏ các công việc tiếp theo như xem xét và xác minh. Bạn đã từng gặp phải vấn đề tương tự trong công việc hàng ngày, như vấn đề mà nhóm Microsoft Exchange và Edge gặp phải, và bạn đã giải quyết nó như thế nào?
 
Back
Top