Компания Luma AI представила свою инновационную модель под названием Uni-1, в которой соединены возможности понимания и генерации изображений. Эта модель, как и Nano Banana Pro от Google и GPT Image 1.5, использует авторегрессионный трансформер, создавая содержимое поэтапно, токен за токеном, в отличие от классических диффузионных моделей, которые извлекают изображение из шума.
Согласно разработчикам, Uni-1 способна анализировать запросы до их генерации, разбивая сложные инструкции и продумывая компоновку сцен. Это значительно увеличивает точность выполнения запросов, позволяя модели комбинировать несколько снимков в единую композицию.
Дополнительно, Uni-1 может дорабатывать изображения в ходе диалога, сохраняя контекст. Она поддерживает более 76 художественных стилей, обрабатывает эскизы и может перенести элементы с референсных фото на новые картины. В одной из демонстраций модель создала серию изображений, визуально «старя» пианиста от юности до старости. По результатам теста RISEBench Uni-1 показала высокий результат, немного опередив Nano Banana 2 и GPT Image 1.5, а также демонстрирует сильные способности в распознавании объектов, сопоставимые с Gemini 3 Pro от Google. Модель поддерживает множество языков.