В апреле вышла новая модель GPT Images 2. После тестирования в течение нескольких дней выяснилось, что AI-инструмент действительно стал работать лучше. Особенно это проявилось в создании изображений с текстом.
Пользователи обратили внимание, что GPT Images 2 перестала делать ошибки в фразах, сложных для нейронки словах даже на кириллице. Судя по всему, теперь не нужно дорабатывать промпт, следить за тем, чтобы не было длинных слов.
Разбираемся в этом материале, какие теперь изображения можно получить от ChatGPT.
Какие обновления появились в новой AI-модели
GPT Images 2 могут использовать владельцы free и pro-аккаунтов. Разница лишь в том, что у вторых больше попыток генерации. Пользоваться ИИ-инструментом можно прямо в Chat GPT.

Что конкретно поменялось в GPT Images 2:
- создание картинки за несколько этапов: доработка промпта, набросок, черновой результат и его доработка;
- загружено больше знаний о реальном мире;
- более стабильное сохранение контекста: нейросеть лучше запоминает героев на прошлых изображениях, что хорошо для маскотов;
- автоматический поиск подобных картинок под запрос, использование их в качестве референса;
- более качественный анализ текста и добавление слов на изображение без ошибок.
Благодаря обновленной базе данных GPT Images 2 теперь лучше узнает бренды, изображает их на фото. AI теперь еще удобнее использовать для инфографики и даже воссоздания интерфейсов известных сайтов.
Начало использования и примеры генерации от AI-модели
Нейросеть работает прямо в стандартном интерфейсе ChatGPT, но можно перейти и на отдельный сайт инструмента.

Но если доступа к нейросети нет, то некоторые агрегаторы уже добавили эту модель. Однако результат в этом случае может отличаться.
Промпт для реалистичного фото: Фотореалистичное фото сибирского кота, лежащего на стеклянном столе с бело-рыжим окрасом и густой пушистой шерстью. Глаза с теплым желтым оттенком, естественный взгляд, реалистичная текстура меха и мягкий дневной свет. Крупный план, профессиональная съемка, максимальная детализация.
Что получилось:

Также в Open AI заявили генерацию интерфейсов в обновленном инструменте. Давайте посмотрим, что может делать нейросеть.
Запрос, который использовали для этого: Сделай реалистичный скриншот интерфейса YouTube на русском языке: Главная страница канала MrBeast с фирменной красной темой, строкой поиска, боковым меню и сеткой видеороликов. Покажи узнаваемый стиль канала MrBeast: крупные яркие превью, контрастные заголовки и современный YouTube UI без лишних элементов.
Результат:

Также GPT Images 2 научился делать апскейл изображения. Промпт для теста этой функции: Увеличь разрешение прикрепленного изображения с помощью GPT Image 2, сохранив все детали и оригинальные цвета. Улучши четкость, текстуру и резкость, устранив шум и размытость без изменений в композиции. Сделай фото сверхдетализированным, реалистичным и профессиональным.
Какое фото было до обработки:

Что получилось после редактирования:

В целом пользователи отмечают, что у GPT Image 2 стало меньше «галлюцинаций» наподобие склеенных пальцев, нечитаемых надписей, «плывущих» объектов. Предлагаем затестить нейронку самостоятельно, чтобы составить собственное мнение.
Если хочется попробовать новую модель ChatGPT на телефоне, то узнайте, как это сделать для Android, iOS.
Какие в итоге плюсы и минусы GPT Image 2
Главная особенность нейронки это изображение текста на картинке без ошибок на разных языках, в том числе на русском. Если раньше требовалось несколько новых генераций (и не факт, что ошибка была бы устранена), то теперь в GPT Image 2 изображения могут получаться с первого раза.
Однако это не единственное преимущество новой модели. Подробнее о плюсах и минусах GPT Image 2:
| Плюсы | Минусы |
| Отсутствие желтого оттенка на картинках, где его не должно быть | Генерация в 1-2К, а не 4К, как было заявлено |
| Сохранение узнаваемого лица персонажей на нескольких визуалах | Добавление надписей, куда не нужно |
| Обновленные знания о мире: интерфейсы получаются похожими | Ошибки на специфичных темах: доисторические животные, малоизвестное техническое оборудование |
GPT Image 2 также быстрее своего предшественника. Но на воссоздании сложной геометрии по-прежнему бывают ошибки.
FAQ
Разные нейросети подходят для разных задач. Nano Banana по-прежнему точнее при генерации сложной геометрии предметов. Но при этом у GPT Image 2 более насыщенные оттенки и кинематографичность. Использовать ту или другую модель дело вкуса.
Пользователи особенно отмечают отсутствие типичных «галлюцинаций»: мутных странных объектов на фоне, искажений черт лица. Модель также стала качественнее редактировать изображения: менять детали, текст.
В целом структура осталась той же: Сцена + Субъект + Детали + Ограничения (негативный запрос).
Поддерживает 2K, популярные размеры: 1024x1024, 1536x1024, 2048x2048, 3840x2160 и соотношения от 3:1 до 1:3.
Поддерживает фотореализм, аниме, UI, текст; excels в сложных сценах с освещением и тенями.
