benchmark ai

  1. Mẫn Nhi

    DeepSeek V4 Pro có điểm benchmark thất vọng, nhưng lại "out trình" Claude Opus 5 ở khía cạnh này

    DeepSeek vừa lặng lẽ tung ra bản cập nhật cho mô hình đầu bảng của mình mang tên DeepSeek-V4-Pro-0813. Khác với những màn chào sân rầm rộ trước đây, lần xuất hiện này của startup Trung Quốc mang lại cảm xúc khá trái chiều cho cộng đồng công nghệ: người cần code hay làm tài chính thì thở dài...
  2. Mẫn Nhi

    Mô hình Gemini 3.6 Flash của Google vừa ra mắt đã bị chê, thua "từ Đông tới Tây"

    Kỳ vọng nhiều nhưng thể hiện chẳng bao nhiêu, Gemini 3.6 Flash của Google vừa ra mắt đã vấp phải nhiều phản hồi tiêu cực khi điểm hiệu năng thực tế bị hàng loạt đối thủ vượt mặt. Thông số công bố hấp dẫn nhưng chọn sai thời điểm Google chào sân Gemini 3.6 Flash với cửa sổ ngữ cảnh lên tới 1...
  3. T

    Tại sao AI của Baidu lại có thể đánh bại cả GPT và Gemini?

    Liệu AI có thể hiểu bản vẽ kỹ thuật, đọc biểu đồ, xem video và còn “hành động” thay con người trong doanh nghiệp không? Khi Baidu đưa AI vượt khỏi giới hạn “đọc chữ” Một bước ngoặt thú vị trong cuộc đua AI: Baidu vừa công bố mô hình ERNIE 4.5-VL-28B-A3B-Thinking, phiên bản AI đa phương thức có...
Back
Top