Liệu mô hình xử lý ảnh thô mạnh mẽ nhất sắp ra mắt? Theo các nguồn tin, OpenAI đang bí mật thử nghiệm GPT Image 2.5

OpenAI có thể đang thử nghiệm một mô hình xử lý hình ảnh AI mới. Trong hai ngày qua, một số người dùng ở nước ngoài đã phát hiện ra một thiết bị có tên là luna-lisa-alpha. Người mẫu bí ẩn xuất hiện tại LMARaenaTrên nền tảng thử nghiệm.
1787298865969.png
Dựa trên các kết quả thử nghiệm đã bị rò rỉ cho đến nay, luna-lisa-alpha đã có những cải tiến đáng kể ở một số lĩnh vực, bao gồm tính nhất quán của người thật, độ chân thực của hình ảnh, khả năng tạo văn bản và vấn đề nhiễu ảnh luôn tồn tại trong các phiên bản GPT Image trước đây.
1787298970314.png
Mặc dù OpenAI chưa công khai xác nhận sự tồn tại của mô hình này, nhiều người thử nghiệm suy đoán rằng đây có thể là phiên bản đầu tiên của GPT Image 2.5 hoặc thế hệ tiếp theo của mô hình GPT Image. Neuro Pulse, một trong những người dùng đầu tiên phát hiện ra luna-lisa-alpha, đã tuyên bố trên X rằng đây là một " điểm kiểm tra hình ảnh GPT mới" hiện đang được thử nghiệm.Phiên bản thử nghiệm trước đó trong cùng loạt bài này là mona-lisa-1.
1787299314375.png
Điểm kiểm tra là một giai đoạn trong quá trình huấn luyện mô hình, thường được sử dụng để thử nghiệm nội bộ và đánh giá khả năng, và không đại diện cho phiên bản phát hành công khai cuối cùng. Trong số rất nhiều báo cáo phản hồi thử nghiệm, "tính nhất quán" là từ khóa được nhắc đến thường xuyên nhất. So với các phiên bản trước, luna-lisa-alpha có khả năng duy trì ngoại hình, trang phục và phong cách tổng thể của nhân vật tốt hơn khi tạo cùng một nhân vật liên tục. Theo người dùng thử nghiệm Token Gremlin, thay đổi lớn nhất trong luna-lisa-alpha có lẽ không phải là sự cải thiện về chất lượng của từng hình ảnh riêng lẻ, mà là sự ổn định được nâng cao. Ông tin rằng phiên bản mới đang cải thiện hai vấn đề: thứ nhất, tính nhất quán giữa các kết quả được tạo ra khác nhau, và thứ hai, độ nhiễu và hạt mờ tồn tại trong các phiên bản trước của GPT Image.

Một người dùng khác, Mirochill, cũng nhận xét sau khi thử nghiệm rằng phiên bản mới dường như có ít nhiễu hạt hơn trong ảnh so với phiên bản mona-lisa-1 trước đó, trong khi độ nhất quán của các nhân vật đã được cải thiện đáng kể.
1787299396526.png
Tuy nhiên, một số người thử nghiệm vẫn phát hiện ra rằng ở những khu vực có kết cấu phức tạp, mây, cây cối và các chi tiết khác, vẫn còn những mẫu bất thường (kết cấu lặp lại) trong hình ảnh.
1787299745882.png
Bên cạnh tính chân thực được cải thiện, khả năng tạo văn bản của luna-lisa-alpha cũng đã thu hút được sự chú ý. GPT Image 2 đã đạt được những tiến bộ đáng kể trong lĩnh vực này, và một số người thử nghiệm hiện đang sử dụng nó để tạo giao diện di động, bản nháp thiết kế web và các nội dung khác, nhận thấy rằng mô hình này có thể tạo ra các yếu tố giao diện người dùng tương đối phức tạp.
1787299882747.png
Đúng vậy, ngay cả hình ảnh giao diện trang web chính thức của iPhone màn hình gập cũng có thể dễ dàng được tạo ra trực tiếp, nhưng nó không hoàn toàn giống với hình ảnh mô phỏng bị rò rỉ hiện tại (hình chú chó Doge).
1787299920546.png

Người dùng Mark Kretschmann tin rằng tầm quan trọng của các mô hình hình ảnh có thể bị đánh giá thấp vì chúng không chỉ có thể tạo ra hình ảnh trong tương lai mà còn trực tiếp tham gia vào thiết kế trang web, tạo mẫu sản phẩm và thậm chí cả chuyển đổi mã.

Ngoài ra, một số người thử nghiệm đã bắt đầu so sánh trực tiếp luna-lisa-alpha với các mô hình xử lý ảnh phổ biến hiện nay.

Người dùng Harshith cũng chia sẻ kết quả thử nghiệm từ lần sử dụng đầu tiên của mình với luna-lisa-alpha, so sánh nó với các mô hình như GPT Image 2.0 và Nano Banana Pro với cùng một bộ câu hỏi gợi ý.
1787299974929.png

1787299987608.png

Cũng giống như cộng đồng đã phát hiện ra luna-lisa-alpha, OpenAI hôm nay cũng đã phát hành một tính năng mới cho API GPT Image 2. OpenAI cho biết API GPT Image 2 đang trong giai đoạn xem trước hỗ trợ tạo nền trong suốt, cho phép người dùng tạo ra các chất liệu có thể được áp dụng trực tiếp lên các nền khác nhau cho hình ảnh sản phẩm, thiết kế web, nội dung tiếp thị và các trường hợp khác. Một số người dùng suy đoán rằng OpenAI có thể đang tiến hành thử nghiệm A/B thông qua nhiều điểm kiểm tra khác nhau. Ngoài mẫu mona-lisa-1 đã đề cập trước đó, các tên như lina-alpha cũng xuất hiện trên LMARaena. Một số người thử nghiệm tin rằng đây có thể là các phiên bản thử nghiệm khác nhau của cùng một dòng sản phẩm.

Tất nhiên, vẫn còn nhiều điều chưa chắc chắn trước khi phát hành chính thức. Liệu luna-lisa-alpha cuối cùng sẽ trở thành GPT Image 2.5 hay chỉ là một phiên bản trong giai đoạn thử nghiệm nội bộ vẫn còn phải chờ xem và cần có thông báo chính thức từ OpenAI.

Ở một mức độ nào đó, sự xuất hiện của luna-lisa-alpha cũng đã thúc đẩy việc xem xét lại hướng đi của cuộc cạnh tranh trí tuệ nhân tạo.

Trong năm qua, khả năng lập trình đã trở thành một vấn đề được quan tâm hàng đầu trong ngành công nghiệp AI. Từ Claude Code đến các loại Coding Agent khác nhau, khả năng viết mã, sửa đổi mã và hoàn thành các nhiệm vụ phát triển của các mô hình dần trở thành một chỉ số quan trọng để đánh giá sự tiến bộ của năng lực AI.

Tuy nhiên, nhìn lại, điểm khởi đầu để trí tuệ nhân tạo (AI) thâm nhập vào cuộc sống hàng ngày của người dùng thông thường không nên chỉ giới hạn ở việc lập trình. Nội dung đa phương thức như tạo và chỉnh sửa hình ảnh cũng là những nhu cầu thường xuyên, nhưng đã bị đánh giá thấp trong một thời gian dài.

Trí tuệ nhân tạo không chỉ nên là một công cụ giúp một số ít người nâng cao năng suất, mà còn nên trở thành một điểm khởi đầu mới để nhiều người hơn có thể thể hiện bản thân, sáng tạo và giải quyết vấn đề.
 
Back
Top