branding images
branding images

«OpenAI явно ориентируется на профи». Эксперт прокомментировал выход GPT Image 1.5

«OpenAI явно ориентируется на профи». Эксперт прокомментировал выход GPT Image 1.5
0
27

OpenAI представила крупное обновление инструмента генерации изображений в ChatGPT, сделав новую модель GPT Image 1.5 доступной для всех категорий пользователей — от бесплатного тарифа до разработчиков, работающих через API.

Ключевым улучшением стала производительность: скорость генерации изображений выросла примерно в четыре раза. Одновременно модель стала точнее интерпретировать сложные и многоступенчатые запросы, лучше следуя инструкциям пользователя и корректнее обрабатывая детали. Это особенно заметно в задачах, где требуется не просто создать картинку с нуля, а работать с уже существующим изображением.

Теперь пользователи могут вносить локальные правки в готовые изображения — менять освещение, цветовую палитру или выражение лица, не пересобирая сцену целиком. Такой подход упрощает работу с фотографиями, где важно сохранить исходную композицию и узнаваемость человека, но при этом адаптировать отдельные элементы, например, прическу, одежду или стилистику кадра. Модель также лучше справляется с преобразованием фотографий в постеры, рекламные макеты или иллюстрации в аниме-стиле, сохраняя визуальную идентичность оригинала. Отдельно в OpenAI отмечают заметный прогресс в качестве рендеринга текста на изображениях.

В интерфейсе ChatGPT появилась новая вкладка «Изображения», которую в компании называют своего рода творческой студией. В ней собраны готовые шаблоны, популярные сценарии использования и инструменты для быстрого старта. Загруженные изображения можно использовать повторно в новых генерациях без необходимости повторной загрузки, что ускоряет итеративную работу над визуалом.

Руководитель направления приложений OpenAI Фиджи Симо также обозначила дальнейшее направление развития продукта. По ее словам, в перспективе ответы ChatGPT в поисковом режиме будут автоматически дополняться визуальными элементами — графиками и изображениями с указанием источников. Конечная цель — сократить путь от идеи до готового результата и сделать работу с визуальной информацией максимально бесшовной.

Мнение эксперта

Чтобы разобраться в вопросе, мы поговори с экспертом по соцсетях, журналистом Алексеем Оносовым.

«Десятого декабря OpenAI выкатила крупное обновление — модель GPT Image 1.5 теперь доступна всем, даже на бесплатном тарифе. Скорость генерации выросла в четыре раза, качество подтянулось, появилась возможность точечно редактировать детали вроде освещения или мимики без пересоздания всей картинки. Еще добавили отдельную вкладку с шаблонами и фильтрами, плюс намекнули, что скоро ответы в ChatGPT будут сразу дополняться графикой. Вопрос напрашивается сам собой — это технологический прорыв или реакция на изменения на рынке?

Если смотреть на цифры, картина складывается любопытная. Рост ChatGPT замедлился до шести процентов в месяц, а доля OpenAI на корпоративном рынке изменилась с пятидесяти до тридцати четырех процентов за последние месяцы. При этом Anthropic увеличила свою долю вдвое, Google Gemini нарастила присутствие на три процента и показывает хорошую динамику по скачиваниям. Сэм Альтман в начале декабря объявил стратегию «Code Red» — «код красный», если переводить напрямую. Timing интересный, надо признать.

Google Gemini сейчас показывает сильные результаты в мультимодальных задачах — работа с изображениями, видео, длинные контексты. У них полный стек: собственные процессоры TPU, экосистема Android, интеграция с Workspace. Это серьезное преимущество, которое сложно игнорировать. OpenAI же исторически была сильна в тексте, а с картинками случались шероховатости — то инструкции выполнялись не полностью, то текст на изображении получался нечетким. Теперь эти моменты дорабатывают, причем активно. Цену API снизили на двадцать процентов, доступ открыли широкой аудитории.

Рынок генерации изображений растет на двадцать пять — тридцать один процент ежегодно, к 2029 году прогнозируют 2,39 миллиарда долларов. Семьдесят четыре процента этого рынка — корпоративный сегмент, где важны скорость и интеграция в рабочие процессы. OpenAI явно ориентируется на этот сегмент, позиционируя обновление как переход от экспериментов к практическому инструменту для профессионалов. Когда шестьдесят восемь процентов компаний планируют внедрять мультимодальные решения до конца года, момент подходящий для такого шага.

Так ответ это на конкуренцию или нет? Похоже, что да. Timing точный, функционал развивается именно в тех направлениях, где конкуренты показывают сильные результаты, ценовая политика становится более гибкой. OpenAI укрепляет позиции в мультимодальности и работает над удержанием доли на корпоративном рынке. Технологии впечатляют, скорость реально выросла — но стратегически это скорее адаптация к рыночным условиям, чем революционный прорыв», — Алексей Оносов.

Владислав Долгов
Владислав Долгов
Автор
(Проголосовать за статью)

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

X