Cạnh tranh Trung Quốc và Mỹ trong lĩnh vực mô hình lớn ngày càng gay gắt: Hàng Mỹ giảm giá mạnh để cạnh tranh với Kimi và DeepSeek

From Beijing with Love

Cháu đã lớn thế này rồi à. Lại đây chú ôm cái coi.
Cuộc đua AI đang bước vào giai đoạn khốc liệt nhất từ trước đến nay, khi các ông lớn buộc phải giảm giá sản phẩm để giữ chân người dùng.

Nguyên nhân đến từ Trung Quốc. Kimi K3 của Dark Side of the Moon và DeepSeek V4 Flash xuất hiện với hiệu năng gần như tương đương các mô hình phương Tây, nhưng giá lại rẻ hơn nhiều. Áp lực này buộc OpenAI, Google và cả Anthropic phải phản ứng.

OpenAI là cái tên mới nhất nhập cuộc. Mô hình hàng đầu ChatGPT 5.6 Luna vừa giảm giá tới 80% trên mỗi triệu token, còn mô hình tầm trung 5.6 Terra giảm 20%. Trước đó chỉ hơn một tuần, Google cũng tung ra Gemini 3.6 Flash và 3.5 Flash Lite với mức giá còn thấp hơn. Riêng Anthropic không giảm giá trực tiếp, mà thay mô hình rẻ nhất Opus 4.8 bằng Claude 5.0 mạnh hơn nhưng vẫn giữ nguyên mức giá cũ.

Con số cụ thể cho thấy tốc độ giảm giá đáng kinh ngạc. Hồi tháng 3, ChatGPT 5.4 có giá 2,5 đô la mỗi triệu token đầu vào, tương đương khoảng 64 nghìn đồng, và 15 đô la cho đầu ra, khoảng 383 nghìn đồng. Giờ đây GPT 5.6 Luna chỉ còn 0,20 đô la đầu vào, khoảng 5 nghìn đồng, và 1,20 đô la đầu ra, khoảng 31 nghìn đồng. Nghĩa là chưa đầy bốn tháng, giá một mô hình hàng đầu đã giảm sâu đến vậy, và giờ nằm sát mức giá của DeepSeek V4 Professional, vốn có giá 0,435 đô la đầu vào và 0,87 đô la đầu ra, tương đương khoảng 11 nghìn và 22 nghìn đồng.
1785806494164.png
GPT 5.6 Terra sau khi giảm 20% còn 2 đô la đầu vào và 12 đô la đầu ra, khoảng 51 nghìn và 306 nghìn đồng, thậm chí rẻ hơn cả Kimi K3 vốn có giá 3 đô la và 15 đô la, tương đương 77 nghìn và 383 nghìn đồng. Trong khi đó, mô hình cao cấp nhất GPT 5.6 Sol vẫn giữ nguyên giá 5 đô la và 30 đô la, khoảng 128 nghìn và 765 nghìn đồng. Chế độ Fast của Sol thậm chí còn tăng giá, lên 10 đô la và 60 đô la, khoảng 255 nghìn và 1,53 triệu đồng, để cạnh tranh trực tiếp với các mô hình đỉnh cao như Claude Fable 5 và Mythos 5.

Câu hỏi đặt ra là liệu chiến lược giảm giá này có thực sự sinh lời hay không.

Chi phí vận hành AI vẫn ở mức khổng lồ. OpenAI đã từ bỏ kế hoạch tự xây trung tâm dữ liệu, chuyển sang thuê ngoài, trong đó có thỏa thuận trị giá 300 tỷ đô la với Oracle, tương đương khoảng 7,65 triệu tỷ đồng. Công ty cũng cam kết chi khoảng 600 tỷ đô la, tức khoảng 15,3 triệu tỷ đồng, cho hạ tầng điện toán đến năm 2030. Trong khi đó, mảng thuê bao của OpenAI vẫn đang lỗ, doanh thu chưa đạt kỳ vọng, và công ty được dự báo lỗ hàng chục tỷ đô la trong năm 2025. Đây cũng là lý do có tin đồn Nvidia có thể rót thêm 250 tỷ đô la, khoảng 6,4 triệu tỷ đồng, hỗ trợ OpenAI. Google và Anthropic cũng đang gánh áp lực chi phí tương tự.

Vậy vì sao các công ty vẫn liên tục giảm giá dù chi phí không hề giảm? Câu trả lời nằm ở một lý thuyết kinh tế cũ, gọi là Nghịch lý Jevons. Ý tưởng cơ bản là khi công nghệ rẻ hơn, người dùng sẽ dùng nhiều hơn, và tổng nhu cầu tăng vọt thay vì giảm. Các công ty AI đang đặt cược rằng giá token càng rẻ, người dùng càng dùng nhiều, doanh thu sẽ tăng nhờ quy mô. Họ cũng kỳ vọng vào các thế hệ chip mới, như nền tảng Vera Rubin của Nvidia, có thể tăng hiệu suất xử lý token lên gấp 10 lần, giúp việc kinh doanh AI dần có lãi hơn.

Dù vậy, rất khó hình dung các công ty AI có thể tự trang trải khoản chi phí khổng lồ hiện tại chỉ bằng doanh thu từ chính mảng AI, nhất là khi cuộc đua giảm giá vẫn chưa có dấu hiệu dừng lại.

Giá AI đang rẻ đi từng ngày, nhưng phía sau là một canh bạc lớn về việc liệu số lượng người dùng tăng thêm có đủ bù đắp cho khoản đầu tư khổng lồ hay không.
 
Back
Top