Grok âm thầm được giới lập trình ưa chuộng: Không mạnh nhất, nhưng rẻ và đủ tốt

Thoại Viết Hoàng
Thoại Viết Hoàng
Phản hồi: 0
Trong cuộc đua AI, Grok của Elon Musk lâu nay thường gây chú ý bởi những tranh cãi nhiều hơn năng lực chuyên môn. Nhưng điều đáng chú ý đang diễn ra âm thầm: ngày càng nhiều nhà phát triển bắt đầu sử dụng Grok 4.6 làm mô hình chính, thay thế hoặc giảm phụ thuộc vào GPT và Claude.

Điều thú vị là Grok 4.6 không đứng đầu các bảng xếp hạng. Theo dữ liệu được bài viết dẫn lại, mô hình này đạt 61 điểm trên Artificial Analysis Intelligence Index, ngang GPT-5.6 Sol Max và chỉ kém Fable 5 Max một điểm. Trên CursorBench, kết quả cũng chỉ nằm ở nhóm giữa.

Lợi thế của Grok nằm ở chỗ khác: nó đã vượt qua ngưỡng “đủ tốt” để trở thành công cụ sử dụng hàng ngày. Khả năng xử lý tác vụ phức tạp, gọi công cụ và làm việc liên tục được cải thiện đáng kể. Thay vì thường xuyên mắc kẹt và chờ người dùng can thiệp như trước, Grok hiện có thể kiểm tra kết quả, phát hiện lỗi rồi tiếp tục công việc. Với lập trình viên, một mô hình không đứng đầu mọi bài kiểm tra nhưng làm được phần lớn công việc mà không phải liên tục đổi sang GPT hay Claude lại có giá trị thực tế hơn.
1788273392766.png
Yếu tố thứ hai, và có thể quan trọng hơn, là giá.

Theo mức giá được bài viết đưa ra, API Grok 4.6 có giá 2 USD cho một triệu token đầu vào và 6 USD cho đầu ra, trong khi GPT-5.6 Sol lần lượt là 5 USD và 30 USD, Claude Opus 5 là 5 USD và 25 USD. Với một dự án sử dụng 10 triệu token đầu vào và 2 triệu token đầu ra, phép tính đơn giản cho kết quả khoảng 32 USD với Grok so với 110 USD với GPT-5.6 Sol, chưa tính các yếu tố khác.

Chênh lệch này đặc biệt quan trọng khi AI chuyển từ chatbot hỏi đáp sang AI Agent có thể làm việc hàng giờ, liên tục đọc mã nguồn, gọi công cụ, chạy thử nghiệm, sửa lỗi rồi thực hiện lại. Khi lượng token tăng rất nhanh, mô hình mạnh hơn vài phần trăm nhưng đắt gấp nhiều lần chưa chắc là lựa chọn kinh tế.

Grok cũng đang khắc phục một nhược điểm lớn khác. Trước đây OpenAI có Codex, Anthropic có Claude Code, trong khi Grok chủ yếu tồn tại dưới dạng chatbot và API. Theo bài viết, hệ sinh thái mới đang bổ sung các công cụ để AI có thể trực tiếp đọc, chỉnh sửa mã, chạy lệnh, kiểm thử và điều phối nhiều tác nhân. Nói cách khác, Grok không chỉ được nâng cấp “bộ não” mà bắt đầu có thêm “tay chân” để thực sự làm việc.

Thời điểm cũng đang có lợi cho Grok. Bài viết ghi nhận một bộ phận người dùng Codex phàn nàn về hạn mức ngày càng khó dự đoán, trong khi Claude Code gặp phản ánh về tốc độ tiêu hao hạn mức và một số sự cố dịch vụ trong tháng 8. Khi những công cụ dẫn đầu khiến người dùng không hài lòng, một đối thủ chỉ cần đạt mức đủ tốt, ổn định hơn hoặc rẻ hơn đã có cơ hội chen vào.

Điều đó không có nghĩa Grok đã đánh bại GPT hay Claude. Giá thấp có thể thay đổi, hạn mức sử dụng cũng có thể bị điều chỉnh và các nhà phát triển hoàn toàn có thể chuyển sang mô hình khác.

Nhưng sự nổi lên của Grok cho thấy cuộc cạnh tranh AI đang bắt đầu thay đổi. Khi các mô hình hàng đầu ngày càng tiến gần nhau về năng lực, câu hỏi không còn đơn giản là “AI nào thông minh nhất?”, mà trở thành “AI nào làm được việc ổn định nhất với chi phí hợp lý nhất?”

Với giới lập trình, bảng xếp hạng có thể tạo tiếng vang trong ngày ra mắt. Còn thứ quyết định mô hình nào được sử dụng hàng ngày cuối cùng vẫn là khả năng hoàn thành công việc, hạn mức sử dụng và hóa đơn phải trả.
 
Back
Top