OpenAI giảm giá AI 80%: Cuộc chiến sinh tồn hay canh bạc lợi nhuận?

Derpy
Derpy
Phản hồi: 0
  • Thread starter Thread starter Derpy
  • Ngày gửi Ngày gửi

Derpy

Intern Writer
Thị trường trí tuệ nhân tạo đang chứng kiến một cuộc đua giảm giá khốc liệt, đến mức chúng ta phải tự hỏi: liệu AI có đang trở nên quá rẻ, và điều này có bền vững không?

Để đối phó với sự trỗi dậy mạnh mẽ của các mô hình AI thế hệ mới từ Trung Quốc như Kimi K3 của Moonshot AI hay DeepSeek V4 Flash, các ông lớn công nghệ toàn cầu đang đồng loạt hạ giá sản phẩm và nâng cấp khả năng của các mô hình cấp thấp.

Mới đây nhất, OpenAI đã gây sốc khi giảm giá tới 80% cho mô hình tiên tiến cơ bản ChatGPT 5.6 Luna (tính theo mỗi triệu Token), đồng thời hạ 20% giá của mô hình tầm trung 5.6 Terra. Chỉ hơn một tuần trước đó, Google cũng đã tung ra các mô hình Gemini 3.6 Flash và 3.5 Flash-Lite với mức giá cạnh tranh hơn. Dù không trực tiếp giảm giá, Anthropic cũng đã thay thế mô hình Opus 4.8 có giá thấp nhất của mình bằng Claude 5.0 mạnh mẽ hơn, nhưng vẫn giữ nguyên mức giá cũ.
1785815828760.png
Sự cạnh tranh gay gắt này đang đẩy khả năng AI trở nên rẻ hơn bao giờ hết, nhưng nó cũng đặt ra câu hỏi lớn về lợi nhuận của các công ty AI hàng đầu. Trong những tháng gần đây, nhiều doanh nghiệp AI lớn đã phải cắt giảm chi phí, thậm chí hạn chế phạm vi sử dụng công nghệ AI, kể cả những công ty từng rất tích cực thúc đẩy AI như xAI của Elon Musk. Dù ngày càng nhiều nhân viên sử dụng AI, các báo cáo hiện tại cho thấy năng suất thực tế chưa đạt được mức tăng trưởng như kỳ vọng.

Cuộc đua AI giữa Mỹ và Trung Quốc đang ngày càng nóng bỏng, phản ánh phần nào lợi thế công nghiệp lâu dài của mỗi quốc gia. Các công ty Mỹ thường đổ hàng tỷ đô la vào việc phát triển công nghệ tiên tiến nhất, trong khi các nhà phát triển Trung Quốc lại tận dụng năng lực sản xuất và kỹ thuật mạnh mẽ để tạo ra các mô hình AI với chi phí thấp hơn, quy mô tinh gọn hơn, nhưng hiệu năng cao, gần như không thua kém ở các khả năng cao cấp.

DeepSeek V4 từng tạo ra một cú sốc lớn cho các nhà phát triển AI phương Tây vào năm 2025, và Kimi K3 tiếp tục gây ảnh hưởng tương tự vào năm 2026. Chỉ riêng những sự kiện này đã đủ để OpenAI, Google và Anthropic cảm thấy áp lực.

Trong nhiều tháng trước đó, các doanh nghiệp sử dụng AI quy mô lớn đã liên tục than phiền về chi phí Token tăng nhanh. Vì vậy, khi thị trường xuất hiện những mô hình mới với hiệu năng tương đương nhưng giá thành giảm đáng kể, toàn bộ ngành công nghiệp đã rung chuyển.

Giờ đây, các công ty AI lớn không thể chỉ đơn thuần cạnh tranh bằng cách tăng số lượng tham số mô hình hay quy mô dữ liệu huấn luyện nữa. Họ buộc phải bước vào cuộc chiến giá cả thực sự, và OpenAI đã đi tiên phong với việc giảm giá mạnh cho một số mô hình của mình.

Điều đáng chú ý là OpenAI không hề giảm giá cho các mô hình flagship mạnh nhất của mình. Thậm chí, phiên bản nhanh hơn của mô hình này còn tăng giá. Tuy nhiên, các mô hình tiên tiến của họ hiện đã đạt mức giá thấp kỷ lục, và tốc độ cải thiện khả năng AI cùng với việc giảm giá đang diễn ra một cách chóng mặt.

Hồi tháng 3 năm nay, OpenAI ra mắt ChatGPT 5.4 với khả năng tác nhân mạnh mẽ hơn, có giá 2,5 USD (khoảng 63.625 VNĐ) cho mỗi triệu Token đầu vào và 15 USD (khoảng 381.750 VNĐ) cho mỗi triệu Token đầu ra.

Hiện tại, giá của GPT 5.6 Luna đã giảm xuống chỉ còn 0,20 USD (khoảng 5.090 VNĐ) cho mỗi triệu Token đầu vào và 1,20 USD (khoảng 30.540 VNĐ) cho mỗi triệu Token đầu ra. Điều này có nghĩa là một mô hình tiên tiến đã giảm giá mạnh chỉ trong vòng chưa đầy 4 tháng kể từ khi ra mắt.

Sau đợt giảm giá này, Luna đã nằm trong phạm vi cạnh tranh với DeepSeek V4. Phiên bản chuyên nghiệp của DeepSeek V4 có giá 0,435 USD (khoảng 11.071 VNĐ) cho mỗi triệu Token đầu vào và 0,87 USD (khoảng 22.132 VNĐ) cho mỗi triệu Token đầu ra.

GPT 5.6 Terra, một mô hình mạnh hơn, sau khi giảm giá 20%, cũng có giá 2 USD (khoảng 50.900 VNĐ) cho mỗi triệu Token đầu vào và 12 USD (khoảng 305.400 VNĐ) cho mỗi triệu Token đầu ra, thấp hơn cả Kimi K3 (3 USD, tương đương 76.350 VNĐ cho đầu vào và 15 USD, tương đương 381.750 VNĐ cho đầu ra).

Trong khi đó, GPT 5.6 Sol vẫn giữ nguyên giá 5 USD (khoảng 127.250 VNĐ) cho đầu vào và 30 USD (khoảng 763.500 VNĐ) cho đầu ra. Thậm chí, OpenAI còn tăng giá cho mô hình cao cấp nhất của mình: chế độ Fast của 5.6 Sol có giá 10 USD (khoảng 254.500 VNĐ) cho đầu vào và 60 USD (khoảng 1.527.000 VNĐ) cho đầu ra, nhằm cung cấp cùng mức độ thông minh với độ trễ thấp hơn, cạnh tranh trực tiếp với các mô hình flagship như Claude Fable 5 và Mythos 5.

Tuy nhiên, câu hỏi đặt ra là: liệu những chiến lược giảm giá này có thực sự mang lại lợi nhuận cho OpenAI?

Áp lực chi phí đang ngày càng lớn. Đầu năm nay, sau khi OpenAI từ bỏ kế hoạch tự sở hữu các trung tâm dữ liệu riêng, các hợp đồng thuê với các "nhà cung cấp đám mây mới" (Neoclouds) trở nên cực kỳ quan trọng. Chẳng hạn, thỏa thuận mua sắm tài nguyên điện toán trị giá 300 tỷ USD (khoảng 7.635 nghìn tỷ VNĐ) với Oracle đã trở thành nền tảng quan trọng để các dịch vụ của OpenAI có thể tiếp tục hoạt động.

Nếu trước đây, nhiều người còn nghi ngờ về khả năng OpenAI chi trả những khoản chi phí khổng lồ này, thì giờ đây, những nghi vấn đó càng trở nên rõ ràng hơn. OpenAI hiện đang liên tục thua lỗ trong mảng kinh doanh đăng ký và đã không đạt được các mục tiêu doanh thu quan trọng vào đầu năm nay. Ngay cả khi doanh thu tiếp tục tăng trưởng, công ty vẫn lỗ hàng trăm tỷ USD vào năm 2025.

OpenAI đã cam kết đầu tư khoảng 600 tỷ USD (khoảng 15.270 nghìn tỷ VNĐ) vào tài nguyên điện toán cho đến năm 2030. Ngay cả khi doanh thu tiếp tục tăng, nó cũng khó có thể bù đắp được khoản chi phí khổng lồ này. Việc các mô hình phổ biến nhất và có giá thấp nhất tiếp tục giảm giá đồng nghĩa với việc biên lợi nhuận của công ty có thể bị thu hẹp đáng kể, thậm chí biến mất hoàn toàn. Đây có lẽ là một trong những lý do khiến giới phân tích bàn tán về khả năng Nvidia có thể đầu tư 250 tỷ USD (khoảng 6.362,5 nghìn tỷ VNĐ) để hỗ trợ OpenAI.

Tất nhiên, OpenAI không phải là doanh nghiệp duy nhất đối mặt với vấn đề này. Trong năm qua, Google đã chi khoảng 9 lần doanh thu mảng điện toán đám mây của mình cho cơ sở hạ tầng AI. Anthropic gần đây mới đạt được lợi nhuận doanh thu hàng năm, chủ yếu nhờ vào một thỏa thuận hợp tác hạn chế với xAI để thuê trung tâm dữ liệu Colossus với giá thấp.

Chi phí vận hành và xây dựng AI không hề giảm đột ngột, nhưng các doanh nghiệp lại liên tục hạ giá, cung cấp các mô hình nhanh hơn, mạnh hơn với chi phí thấp hơn. Nhìn bề ngoài, những con số này dường như không hợp lý chút nào.

Ngành công nghiệp AI thường viện dẫn "Nghịch lý Jevons" để giải thích tốc độ phổ biến AI ngày càng nhanh. Vào thời của Jevons, động cơ than hiệu quả hơn không làm giảm tiêu thụ than, mà ngược lại, do phạm vi sử dụng mở rộng đã khiến tổng nhu cầu than tăng lên.

Ngày nay, các công ty AI tin rằng, khi chi phí sử dụng AI giảm, mọi người sẽ tìm thấy nhiều ứng dụng hơn, từ đó thúc đẩy tổng lượng sử dụng AI tăng lên đáng kể. Đây có thể chính là logic đằng sau chiến lược giảm giá Token hiện tại.

Nếu Token đủ rẻ, người dùng sẽ tăng cường sử dụng một cách ồ ạt, từ đó mang lại doanh thu cao hơn thông qua tăng trưởng quy mô. Hơn nữa, từ cuối năm nay trở đi, chip tăng tốc AI thế hệ mới sẽ phổ biến hơn trong các trung tâm dữ liệu, khả năng xử lý Token trên mỗi đơn vị công suất có thể tăng gấp 10 lần, giúp các hoạt động kinh doanh với biên lợi nhuận thấp hơn vẫn có thể sinh lời nhờ quy mô.

Ngoài ra, nền tảng Vera Rubin sắp tới của Nvidia cũng rất đáng chú ý. Nvidia tuyên bố rằng nền tảng này sẽ tiếp tục mang lại hiệu quả hiệu suất Token tăng gấp 10 lần nữa.

Về lý thuyết, lợi thế của các nền tảng Blackwell và Vera Rubin có thể biến máy chủ suy luận AI thành một ngành công nghiệp có tiềm năng sinh lời cao hơn. Tuy nhiên, ngay cả như vậy, thật khó để hình dung các công ty AI lớn có thể chỉ dựa vào doanh thu từ AI để bù đắp các khoản chi phí khổng lồ hiện tại, đặc biệt trong bối cảnh cạnh tranh ngày càng gay gắt và giá Token liên tục giảm.
 
Back
Top