Design Искусственный интеллект Медиа
OpenAI теперь поставляет модели генерации изображений для творческой студии Adobe
OpenAI выпустила ChatGPT Images 2.5 с двумя новыми моделями API, одну из которых Adobe уже интегрировала в Firefly.
Компания заявляет, что каждую неделю в ChatGPT и через его API создается более 3 миллиардов изображений. Примечательные нововведения относятся скорее к интерфейсу, а не к исследованиям моделей, включая возможность делиться текстовым запросом (промптом) вместе с изображением.
OpenAI выпустила ChatGPT Images 2.5 во вторник. В своем заявлении компания отметила, что модель обеспечивает более высокую детализацию, точное редактирование и задержку до 50% ниже, чем Images 2.0.
Разработчикам стали доступны две новые модели. GPT-Image-2.5 Flare является моделью по умолчанию, а Sunburst представляет собой более медленный вариант с расширенными возможностями контроля для профессиональной творческой работы.
Adobe — один из первых клиентов
Деталь, на которой стоит остановиться — это отзывы. В Adobe сообщили, что новые модели GPT-Image-2.5 теперь внедрены в Firefly, их студию креативного искусственного интеллекта.
Мэтт Чотин (Matt Chotin), старший директор по продуктам в Adobe, охарактеризовал Firefly как инструмент, объединяющий ведущие модели ИИ с собственными инструментами Adobe в едином пространстве. Таким образом, компания позиционирует себя прежде всего как интерфейс, а не только как разработчика моделей.
Это осознанная стратегия, а не уступка. Firefly создавался как интерфейс для естественного общения со всем набором инструментов, и возможность выбора моделей является частью этой концепции.
Трафик идет в обе стороны
Adobe также присутствует внутри ChatGPT. Там доступно более 70 инструментов Adobe.
Таким образом, каждая компания выступает каналом дистрибуции для другой. Ни одна из них не может быть до конца уверена, что контролирует момент начала творческого процесса.
Эта неопределенность и составляет суть всей конкурентной борьбы в сфере креативного ПО на данный момент. Тот, кому принадлежит отправная точка, захватывает весь рабочий процесс.
Промпты становятся объектами
OpenAI отвечает на этот вызов с помощью социальной функции. Теперь при публикации изображения можно прикрепить создавший его промпт, чтобы кто-то другой мог запустить его со своими собственными фотографиями.
В качестве примера OpenAI ссылается на вирусный промпт для портретов в стиле 1980-х годов. По сути, это маркетинговый инструмент продвижения, замаскированный под удобную функцию.
Промпт, которым можно поделиться — это шаблон, распространяющийся самостоятельно. Он также удерживает пользователей внутри ChatGPT, а не на чужих творческих платформах.
Остальные новые функции служат той же цели
Функция Sketch позволяет рисовать прямо в ChatGPT и использовать рисунок в качестве референса. Шаблоны предлагают готовые форматы, такие как постеры и мерчандайз, а комментарии можно оставлять прямо на изображении.
Все это не имеет отношения к исследованиям моделей. Это работа над интерфейсом, а интерфейс — это то, что заставляет людей оставаться.
Доступность функции широкая. Версия Images 2.5 развертывается для пользователей ChatGPT, ChatGPT Work и Codex на всех тарифах, на компьютерах, мобильных устройствах и в веб-версии.
Три миллиарда в неделю
Цифра, отражающая масштаб, заслуживает отдельного внимания. По данным OpenAI, каждую неделю через ChatGPT Images и модели GPT-Image в API создается более 3 миллиардов изображений.
Это собственная статистика компании, которая не проходила независимый аудит. Если принять ее на веру, это колоссальный объем синтетических изображений, ежегодно поступающий в обращение.
OpenAI заявляет, что применяет метаданные C2PA и невидимые водяные знаки, а также проводит проверки промптов и изображений, и уже опубликовала системную карту релиза. Маркировка происхождения при таких объемах — это серьезное инженерное обязательство.
Выживет ли происхождение при столкновении с реальностью
Маркировка изображений необходима, но недостаточна. Метаданные регулярно удаляются платформами, скриншотами и перекодированием, а невидимые водяные знаки обладают разной степенью устойчивости.
Регуляторы всё еще пытаются юридически определить статус всех этих технологий. Бразилия, например, занялась определением того, что именно считается дипфейком в преддверии выборов.
Функция обмена промптами в некотором смысле противоречит концепции происхождения. Она облегчает воспроизведение узнаваемого стиля множеством людей с помощью одного и того же «рецепта».
Конкурентная картина
Улучшения в работе с опорными фотографиями (reference photos) нацелены на наиболее коммерчески ценное применение. Размещение реального человека или продукта в новых декорациях — это именно то, что нужно в рекламе, электронной коммерции и создании контента для соцсетей.
Компания Higgsfield и Manus, упомянутые в анонсе, строят свои продукты на базе API, а не конкурируют с ним. По собственным оценкам Manus, модель Flare работает в два-четыре раза быстрее предыдущей версии.
Другие идут по иному пути. Freepik провел ребрендинг в Magnific, превратившись в прибыльную творческую ИИ-платформу с регулярным доходом в 230 миллионов долларов, работающую как самостоятельное направление.
За чем стоит следить
Стоит понаблюдать, продолжит ли Adobe называть своих поставщиков моделей. Студия, агрегирующая различные модели, сильна, пока может выбирать, и становится уязвимой, если один из поставщиков превращается в незаменимого.
Также стоит следить за статистикой использования общих промптов, если OpenAI когда-нибудь ее опубликует. Adobe собирает собственный ответ на базе Firefly, GenStudio и партнерских программ, и основная борьба разворачивается вокруг того, где именно начинается работа, а не какая именно модель ее визуализирует.


