Mẫn Nhi✔
Admin xinh gái
DeepSeek vừa lặng lẽ tung ra bản cập nhật cho mô hình đầu bảng của mình mang tên DeepSeek-V4-Pro-0813. Khác với những màn chào sân rầm rộ trước đây, lần xuất hiện này của startup Trung Quốc mang lại cảm xúc khá trái chiều cho cộng đồng công nghệ: người cần code hay làm tài chính thì thở dài, nhưng giới an ninh mạng lại được phen bất ngờ.
Đợt cập nhật âm thầm này được thông báo ngắn gọn trên trang chủ của DeepSeek với lời hứa hẹn cải thiện đáng kể năng lực AI agent, trước khi dòng thông báo bất ngờ bị gỡ xuống. Đáng chú ý, hãng cũng chưa công bố bài viết kỹ thuật (technical blog post) chi tiết như thông lệ của các phòng lab AI.

Trên bảng xếp hạng Artificial Analysis Intelligence Index, DeepSeek-V4-Pro-0813 đạt 53 điểm. Con số này ngang bằng với GLM-5.2 của Zhipu AI, nhưng kém 4 điểm so với bản tầm trung Terra thuộc dòng GPT-5.6 của OpenAI và thua Kimi K3 của Moonshot AI tới 7 điểm.
Tại bảng xếp hạng Vals Index do Vals AI tổng hợp:
* Model mới của DeepSeek chỉ khiêm tốn đứng ở vị trí thứ 12.
* Tụt lại phía sau cả thế hệ cũ GPT-5.5 của OpenAI, đồng thời cách một khoảng khá xa so với Kimi K3 hay Claude Opus 5 của Anthropic.
* Gặp khó khăn rõ rệt ở hai bài kiểm tra cụ thể: xử lý tác vụ trong môi trường terminal sandbox và lập mô hình tài chính phức tạp trên bảng tính Excel.
Nhiều lập trình viên trên mạng xã hội phản ánh tình trạng model bất ngờ dừng giữa chừng khi đang chạy các tác vụ viết mã dài, khiến không ít người dùng sớm gắn mác "gây thất vọng" cho bản nâng cấp này.
Đánh giá từ công ty bảo mật Aikido Security (Bỉ) cho thấy model này vượt qua toàn bộ các đối thủ thử nghiệm về khả năng phát hiện lỗ hổng hệ thống. Nhà nghiên cứu Philippe Dourassov của Aikido nhận định, dù độ chuẩn xác (precision) còn đôi chút hạn chế, model của DeepSeek đã phát hiện được số lượng lỗ hổng vượt trội so với Claude Opus 5 lẫn Qwen 3.8 của Alibaba.
Tính trung bình khoảng 6 cent cho mỗi tác vụ, DeepSeek-V4-Pro-0813 đắt hơn một chút so với bản gọn nhẹ GPT-5.6 Luna của OpenAI (5 cent), nhưng vẫn rẻ hơn tới 93% so với Kimi K3 (84 cent). Trước đó, DeepSeek đã thông báo tăng giá đáng kể do nhu cầu sử dụng tăng vọt và khuyến cáo người dùng tính toán kỹ lưỡng mức tiêu thụ.
Song song với việc tung ra bản cập nhật, DeepSeek cũng đang rục rịch chuẩn bị cho ra mắt DeepSeek Harness – một khung phần mềm tương tự như Claude Code, cho phép biến các mô hình ngôn ngữ lớn thành các AI agent tự vận hành. Hãng đã bắt đầu mời các lập trình viên mã nguồn mở tham gia thử nghiệm beta cho công cụ này.
Đợt cập nhật âm thầm này được thông báo ngắn gọn trên trang chủ của DeepSeek với lời hứa hẹn cải thiện đáng kể năng lực AI agent, trước khi dòng thông báo bất ngờ bị gỡ xuống. Đáng chú ý, hãng cũng chưa công bố bài viết kỹ thuật (technical blog post) chi tiết như thông lệ của các phòng lab AI.

Benchmark gây thất vọng: "Gãy cánh" ở terminal và Excel
Sau màn chào sân gây sốc của bản V4 Flash siêu rẻ hồi cuối tháng 7, kỳ vọng đặt vào bản Pro lần này là rất lớn. Tuy nhiên, các bài test hiệu năng thực tế lại cho thấy model này đang hụt hơi trước các đối thủ cùng phân khúc.Trên bảng xếp hạng Artificial Analysis Intelligence Index, DeepSeek-V4-Pro-0813 đạt 53 điểm. Con số này ngang bằng với GLM-5.2 của Zhipu AI, nhưng kém 4 điểm so với bản tầm trung Terra thuộc dòng GPT-5.6 của OpenAI và thua Kimi K3 của Moonshot AI tới 7 điểm.
Tại bảng xếp hạng Vals Index do Vals AI tổng hợp:
* Model mới của DeepSeek chỉ khiêm tốn đứng ở vị trí thứ 12.
* Tụt lại phía sau cả thế hệ cũ GPT-5.5 của OpenAI, đồng thời cách một khoảng khá xa so với Kimi K3 hay Claude Opus 5 của Anthropic.
* Gặp khó khăn rõ rệt ở hai bài kiểm tra cụ thể: xử lý tác vụ trong môi trường terminal sandbox và lập mô hình tài chính phức tạp trên bảng tính Excel.
Nhiều lập trình viên trên mạng xã hội phản ánh tình trạng model bất ngờ dừng giữa chừng khi đang chạy các tác vụ viết mã dài, khiến không ít người dùng sớm gắn mác "gây thất vọng" cho bản nâng cấp này.
Điểm sáng bất ngờ: Máy quét lỗ hổng bảo mật số một
Dù điểm số chung và khả năng code chưa như kỳ vọng, DeepSeek-V4-Pro-0813 lại bất ngờ "tỏa sáng rực rỡ" trong lĩnh vực an ninh mạng.Đánh giá từ công ty bảo mật Aikido Security (Bỉ) cho thấy model này vượt qua toàn bộ các đối thủ thử nghiệm về khả năng phát hiện lỗ hổng hệ thống. Nhà nghiên cứu Philippe Dourassov của Aikido nhận định, dù độ chuẩn xác (precision) còn đôi chút hạn chế, model của DeepSeek đã phát hiện được số lượng lỗ hổng vượt trội so với Claude Opus 5 lẫn Qwen 3.8 của Alibaba.
Giá cước tăng đáng kể, chuẩn bị bước chân vào sân chơi AI Agent
Vấn đề chi phí của bản Pro lần này cũng tạo ra nhiều luồng ý kiến. Model được định giá khoảng 0,44 USD/1 triệu token đầu vào (mức giá bị đánh giá là hơi đắt so với trung vị thị trường 0,33 USD) và 0,87 USD/1 triệu token đầu ra. Hãng cũng áp dụng chính sách tăng giá API vào các khung giờ cao điểm, với mức tăng có thể lên tới gấp 11 lần.Tính trung bình khoảng 6 cent cho mỗi tác vụ, DeepSeek-V4-Pro-0813 đắt hơn một chút so với bản gọn nhẹ GPT-5.6 Luna của OpenAI (5 cent), nhưng vẫn rẻ hơn tới 93% so với Kimi K3 (84 cent). Trước đó, DeepSeek đã thông báo tăng giá đáng kể do nhu cầu sử dụng tăng vọt và khuyến cáo người dùng tính toán kỹ lưỡng mức tiêu thụ.
Song song với việc tung ra bản cập nhật, DeepSeek cũng đang rục rịch chuẩn bị cho ra mắt DeepSeek Harness – một khung phần mềm tương tự như Claude Code, cho phép biến các mô hình ngôn ngữ lớn thành các AI agent tự vận hành. Hãng đã bắt đầu mời các lập trình viên mã nguồn mở tham gia thử nghiệm beta cho công cụ này.