DeepSeek vừa tung biểu phí theo khung giờ cao điểm khiến giá API tăng vọt. Đáng chú ý, việc hệ thống chọn đúng giờ hành chính Bắc Kinh để tăng giá đã vô tình làm lộ tệp người dùng thực tế, xua tan nỗi sợ của giới công nghệ Mỹ về một cuộc "xâm lăng" diện rộng.
Những tuần gần đây, giới công nghệ tại Mỹ liên tục đứng ngồi không yên trước sự bùng nổ của các mô hình AI mã nguồn mở đến từ Trung Quốc. Tuy nhiên, động thái điều chỉnh giá mới nhất của DeepSeek lại cho thấy một bức tranh hoàn toàn khác: người dùng của họ hiện vẫn chủ yếu tập trung tại khu vực châu Á.

Khung giờ này trùng khớp hoàn hảo với nhịp làm việc tại châu Á. Điều này đồng nghĩa với việc các doanh nghiệp Mỹ vẫn chưa ồ ạt chuyển dịch hạ tầng sang DeepSeek như nhiều người lo ngại, giúp Washington tạm thời giải tỏa bớt áp lực cạnh tranh.
Tuy nhiên, lượng người dùng nội địa và khu vực cũng đủ khiến DeepSeek "thở không ra hơi". Trong tháng 7, lượng token xử lý của DeepSeek chỉ xếp sau mỗi Anthropic trên toàn cầu và hoàn toàn có khả năng vươn lên vị trí số một trong những tháng tới.
Tiếp đó, bản V4-Pro ra mắt trên cả nền tảng Chat lẫn API, vượt mặt Opus 4.8 ở hàng loạt bài kiểm tra hiệu năng như Terminal Bench 2.1, Cybergym, DeepSWE và AutomationBench.
Trước áp lực hạ tầng quá lớn, bảng giá mới đã được điều chỉnh tăng mạnh:
Dù DeepSeek cho thấy sức ép với thị trường Mỹ chưa thực sự lan rộng theo múi giờ, quy mô tăng trưởng của AI Trung Quốc vẫn là một con số choáng ngợp. Điển hình là dòng mô hình Qwen của Alibaba.
Trên nền tảng Hugging Face, hệ sinh thái mô hình Qwen hiện đã ghi nhận tới 151.448 bản phái sinh và lượt tải, gấp khoảng 2,6 lần so với toàn bộ các mô hình mã nguồn mở của Meta cộng lại.

Alibaba gần đây liên tục gây chú ý với thế hệ Qwen 3.8. Đứng đầu là Qwen 3.8-Max với 2,8 nghìn tỷ tham số, hiện chỉ xếp sau Kimi K3 của Moonshot về mặt hiệu năng tổng thể.
Ấn tượng hơn cả đối với giới lập trình là phiên bản thu gọn Qwen 3.8 (27 tỷ tham số). Mô hình này mang lại năng lực viết code tiệm cận Opus 4.5 nhưng lại có thể chạy mượt mà ngay trên một chiếc MacBook thông thường. Khi các mô hình mở từ Trung Quốc đang bắt kịp rất nhanh các mô hình độc quyền của OpenAI hay Anthropic, việc chúng phủ sóng khắp cộng đồng lập trình viên chỉ còn là vấn đề thời gian.
Những tuần gần đây, giới công nghệ tại Mỹ liên tục đứng ngồi không yên trước sự bùng nổ của các mô hình AI mã nguồn mở đến từ Trung Quốc. Tuy nhiên, động thái điều chỉnh giá mới nhất của DeepSeek lại cho thấy một bức tranh hoàn toàn khác: người dùng của họ hiện vẫn chủ yếu tập trung tại khu vực châu Á.

Giờ cao điểm "vạch trần" nguồn cơn nghẽn mạng
DeepSeek vừa chính thức áp dụng cơ chế định giá theo khung giờ cao điểm để đối phó với tình trạng quá tải hạ tầng tính toán. Điểm thú vị nằm ở các mốc thời gian bị tính phí đắt hơn: từ 09:00 - 12:00 và 14:00 - 16:00 theo giờ Bắc Kinh.Khung giờ này trùng khớp hoàn hảo với nhịp làm việc tại châu Á. Điều này đồng nghĩa với việc các doanh nghiệp Mỹ vẫn chưa ồ ạt chuyển dịch hạ tầng sang DeepSeek như nhiều người lo ngại, giúp Washington tạm thời giải tỏa bớt áp lực cạnh tranh.
Tuy nhiên, lượng người dùng nội địa và khu vực cũng đủ khiến DeepSeek "thở không ra hơi". Trong tháng 7, lượng token xử lý của DeepSeek chỉ xếp sau mỗi Anthropic trên toàn cầu và hoàn toàn có khả năng vươn lên vị trí số một trong những tháng tới.
Chi tiết mức tăng giá API của DeepSeek
Sự bùng nổ nhu cầu bắt đầu từ cuối tháng 7, khi DeepSeek tung bản cập nhật V4-Flash-0731 (284 tỷ tham số). Dù kích thước khiêm tốn, mô hình này cho hiệu năng tương đương Opus 4.8 của Anthropic (vốn được cho là sở hữu tới hàng nghìn tỷ tham số), với mức giá ban đầu chỉ 0,14 USD cho 1 triệu token đầu vào và 0,28 USD cho 1 triệu token đầu ra.Tiếp đó, bản V4-Pro ra mắt trên cả nền tảng Chat lẫn API, vượt mặt Opus 4.8 ở hàng loạt bài kiểm tra hiệu năng như Terminal Bench 2.1, Cybergym, DeepSWE và AutomationBench.
Trước áp lực hạ tầng quá lớn, bảng giá mới đã được điều chỉnh tăng mạnh:
- V4-Flash (Input): Từ mức 0,14 USD/triệu token tăng lên 0,22 USD (giờ thấp điểm) và 0,44 USD (giờ cao điểm).
- V4-Flash (Output): Từ mức 0,28 USD/triệu token tăng lên 0,66 USD (giờ thấp điểm) và 1,32 USD (giờ cao điểm).
- V4-Pro (Input): Từ mức 0,435 USD/triệu token tăng lên 0,66 USD (giờ thấp điểm) và 1,32 USD (giờ cao điểm).
- V4-Pro (Output): Từ mức 0,87 USD/triệu token tăng lên 1,98 USD (giờ thấp điểm) và 3,96 USD (giờ cao điểm)
Alibaba Qwen đang đè bẹp Meta trên Hugging Face
Dù DeepSeek cho thấy sức ép với thị trường Mỹ chưa thực sự lan rộng theo múi giờ, quy mô tăng trưởng của AI Trung Quốc vẫn là một con số choáng ngợp. Điển hình là dòng mô hình Qwen của Alibaba.
Trên nền tảng Hugging Face, hệ sinh thái mô hình Qwen hiện đã ghi nhận tới 151.448 bản phái sinh và lượt tải, gấp khoảng 2,6 lần so với toàn bộ các mô hình mã nguồn mở của Meta cộng lại.

Alibaba gần đây liên tục gây chú ý với thế hệ Qwen 3.8. Đứng đầu là Qwen 3.8-Max với 2,8 nghìn tỷ tham số, hiện chỉ xếp sau Kimi K3 của Moonshot về mặt hiệu năng tổng thể.
Ấn tượng hơn cả đối với giới lập trình là phiên bản thu gọn Qwen 3.8 (27 tỷ tham số). Mô hình này mang lại năng lực viết code tiệm cận Opus 4.5 nhưng lại có thể chạy mượt mà ngay trên một chiếc MacBook thông thường. Khi các mô hình mở từ Trung Quốc đang bắt kịp rất nhanh các mô hình độc quyền của OpenAI hay Anthropic, việc chúng phủ sóng khắp cộng đồng lập trình viên chỉ còn là vấn đề thời gian.