Встречайте новый инструмент создания изображений в ChatGPT

Попробовать в ChatGPT

В этой публикации рассказывается о запуск функции генерации изображений.

Для текущей версии:

Создавайте изображения в ChatGPT
Примечания к выпуску

Сегодня мы выпускаем новую версию ChatGPT Images, работающую на базе нашей новой флагманской модели генерации изображений. Теперь, создаете ли вы что-то с нуля или редактируете фотографию, вы получите именно тот результат, который себе представляете. Модель выполняет точные правки, сохраняя детали в неприкосновенности, и генерирует изображения в 4 раза быстрее. Кроме того, мы представляем новую функцию Images в ChatGPT, созданную для того, чтобы сделать генерацию изображений увлекательной — пробуждать вдохновение и облегчать творческие поиски.

Новая модель Images сегодня начинает распространяться в ChatGPT для всех пользователей и доступна в API как GPT Image 1.5. Новый интерфейс Images в ChatGPT также становится доступен для большинства пользователей сегодня, а поддержка тарифных планов Business и Enterprise появится позже.

Точные правки с сохранением главного

Теперь, когда вы просите внести изменения в загруженное изображение, модель точнее следует вашему замыслу — вплоть до мелочей, — меняя только то, о чем вы просите, и сохраняя такие элементы, как освещение, композиция и внешность людей, неизменными во всех исходных данных, результатах и последующих правках.

Это позволяет добиваться результатов, точно соответствующих вашему замыслу — более полезного редактирования фотографий, более реалистичной примерки одежды и причесок, а также стилистическихфильтров иконцептуальных трансформаций, сохраняющих сущность исходного изображения. В совокупности эти улучшения означают, что ChatGPT может служить творческой студией у вас в кармане, способной как на практические правки, так и на выразительное переосмысление.

Редактирование

Модель превосходно справляется с различными типами редактирования, включая добавление, удаление, объединение, смешивание и перестановку элементов, поэтому вы получаете желаемые изменения, не теряя того, что делает изображение особенным.

Творческие трансформации

Творческий потенциал модели ярко проявляется в трансформациях, которые изменяют и добавляют элементы (такие как текст и макет), воплощая идеи в жизнь и сохраняя при этом важные детали. Эти трансформации подходят как для простых, так и для более сложных концепций, и их легко опробовать с помощью предустановленных стилей и идей в новой функции ChatGPT Images — писать текстовый запрос не требуется.

Следование инструкциям

Модель точнее следует инструкциям по сравнению с нашей первой версией. Это обеспечивает более точное редактирование, а также создание более сложных оригинальных композиций, в которых взаимосвязи между элементами сохраняются должным образом.

Новый

нарисуй сетку 6×6

Сделай сетку 6 (столбцов) на 6 (строк) из следующих элементов:

Строка 1: греческая буква бета, пляжный мяч, лимон, робот, аквариум, лягушка

Строка 2: богомол, дорогие часы, ванна, солнцезащитные очки, разноцветная бабочка, конверт

Строка 3: почтовая марка, фоторамка, дымящийся пельмень, слово «чудо», горные лыжи, буква Z

Строка 4: унитаз, жетон метро, значок отключения звука, флакон духов, стрекоза, шлем для скейтборда

Строка 5: значок Bluetooth, число 13, зеленое сердце, кубик Рубика, канадская казарка, солдатская каска

Строка 6: белая собака, спасательный жилет, узел, клавиатура, коробка салфеток, число 14

chatgpt-images-instruction-following-new

Предыдущий

нарисуй сетку 6×6

Сделай сетку 6 (столбцов) на 6 (строк) из следующих элементов:

Строка 1: греческая буква бета, пляжный мяч, лимон, робот, аквариум, лягушка

Строка 2: богомол, дорогие часы, ванна, солнцезащитные очки, разноцветная бабочка, конверт

Строка 3: почтовая марка, фоторамка, дымящийся пельмень, слово «чудо», горные лыжи, буква Z

Строка 4: унитаз, жетон метро, значок отключения звука, флакон духов, стрекоза, шлем для скейтборда

Строка 5: значок Bluetooth, число 13, зеленое сердце, кубик Рубика, канадская казарка, солдатская каска

Строка 6: белая собака, спасательный жилет, узел, клавиатура, коробка салфеток, число 14

chatgpt-images-instruction-following-old

Рендеринг текста

Модель делает еще один шаг вперед в рендеринге текста, научившись работать с более плотным и мелким шрифтом.

Дополнительные улучшения качества

Модель также улучшает показатели в других аспектах, которые обеспечивают большую применимость результатов на практике, например, при отрисовке множества мелких лиц и повышении естественности получаемых изображений.

Новое пространство для творчества

В дополнение к генерации изображений путем описания желаемого в сообщении мы представляем специализированный раздел для Images в ChatGPT — доступный на боковой панели в мобильном приложении и на сайте chatgpt.com, — чтобы поиск и создание изображений стали еще быстрее и проще. Он включает в себя десятки предустановленных фильтров и подсказок для вдохновения, которые регулярно обновляются с учетом актуальных тенденций.

В совокупности эти обновления позволяют создавать изображения, которые точнее соответствуют вашему видению: от небольших правок до полного переосмысления.

Улучшения и ограничения

Мы заново запустили множество примеров из нашего первоначального релиза функции генерации изображений для оценки производительности. Модель демонстрирует явные улучшения в самых разных сценариях, хотя результаты по-прежнему остаются несовершенными. Несмотря на то, что этот выпуск знаменует собой значительный прогресс, в будущих итерациях остается еще много возможностей для совершенствования.

GPT Image 1.5 в API

GPT Image 1.5 в API обладает всеми теми же улучшениями, что и ChatGPT Images: модель эффективнее сохраняет и редактирует изображения по сравнению с GPT Image 1.

Вы заметите более стабильное сохранение фирменных логотипов и ключевых визуальных элементов при редактировании, что делает модель отличным инструментом для маркетинга и брендинга (например, при создании графики и логотипов), а также для команд электронной коммерции, создающих полные каталоги изображений товаров (варианты, сцены и ракурсы) на основе одного исходного изображения.

Стоимость входных и выходных данных изображений в GPT Image 1.5 теперь на 20% ниже по сравнению с GPT Image 1, что позволяет генерировать и дорабатывать больше изображений в рамках прежнего бюджета.

Вы можете протестировать новую модель в OpenAI Playground, изучить галерею или прочитать руководство по составлению промптов для вдохновения.

Предприятия и стартапы из самых разных отраслей — включая создателей инструментов для творчества, электронную коммерцию, маркетинговое ПО и другие сферы — уже используют GPT Image 1.5.

Доступность

Новая модель ChatGPT Imagesсегодня начинает развертываться для всех пользователей ChatGPT и API по всему миру. Она работает на базе всех моделей, поэтому вам не нужно выбирать какие-то специальные настройки для ее использования. Версия ChatGPT Images, запущенная ранее в этом году, останется доступной для всех пользователей в качестве кастомного GPT.

Мы верим, что находимся лишь в начале пути того, что может дать генерация изображений. Сегодняшнее обновление — это значительный шаг вперед, за которым последуют новые: от более точного редактирования до более богатых и детализированных результатов на разных языках.

Автор

OpenAI

Участники

Руководство проектом

Габриэль Го (Gabriel Goh) — руководитель исследований

Адель Ли (Adele Li) — руководитель продукта

Билл Пиблз (Bill Peebles) — руководитель проекта Sora

Адитья Рамеш (Aditya Ramesh) — руководитель направления моделирования мира

Марк Чен (Mark Chen) — главный научный сотрудник

Прафулла Дхаривал (Prafulla Dhariwal) — руководитель мультимодального направления

Основная команда

Алекс Фанг, Алекс Ю, Бен Ванг, Бин Лян, Боюань Чэнь, Чарли Нэш, Дэвид Медина, Дибья Бхаттачарджи, Цзяньфэн Ван, Кэнджи Хата, Кихван Сонг, Мэнчао Чжун, Майк Старр, Югуан Ян

Исследователи-участники

Брам Уоллес, Дмитро Охонько, Хайтан Ху, Кшитидж Гупта, Ли Цзин, Лу Лю, Петр Жохов, Цимин Юань, Сентил Пурушвалкам, Ижэнь Чжан

Основная команда инференса

Адам Тарт, Алисса Хуанг, Эндрю Браунштейн, Джейн Парк, Карен Ли, Томер Кафтан

Научные сотрудники-коллабораторы

Адитья Рамеш, Алекс Никол, Эндрю Кондрих, Эндрю Лю, Бенедикт Винтер, Билл Пиблз, Коннор Холмс, Сирил Чжан, Даниэль Ген, Эрик Минтун, Джеймс Беткер, Джейми Кирос, Манука Стратта, Мартин Ли, Рауль де Лидекерке, Рики Ванг, Руслан Василев, Владимир Чалышев, Велтон Ванг, Уятт Томпсон, Ямин Лин

Инженеры инференса

Цзяюй Бай, Кевин Кинг, Стэнли Се, Вэйи Чжэн

Данные и оценка

Александра Барр, Апарна Датта, Арши Бхатнагар, Чао Ю, Шарлотт Коул, Драгош Оприка, Эмма Танг, Говришанкар Сундер, Генри Бэр, Ян Соль, Джеймс Парк Леннон, Джейсон Сюй, Пэйлинь Ян, Сомай Джайн, Сци-чие Ю, Весам Манассра, Сяолей Чжу, Илей Цянь

Прикладные разработчики

Аффонсо Рейс, Алан Гоу, Александра Водопьянова, Амандип Гревал, Анди Лю, Эндрю Сима, Ангус Флетчер, Антония Вудфорд, Арун Эсвара, Бенни Вонг, Бхарат Ранган, Боян Ню, Бриджет Коллинз, Брайан Брандо, Калли Риггинс Зетино, Крис Вендель, Итан Чанг, Гилман Толле, Грег Хохмут, Ибрагим Окуюджу, Джесси Чанд, Джесси Хендрикссон, Цзяюй Бай, Джимми Лин, Йохан Сервантес, Кан Ву, Лиам Эспаррагера, Майя Вичровска, Мэтью Феррари, Мурат Есильдал, Никунд Ханда, Нитанту Кудиге, Ола Окелола, Осман Хваджа, Питер Аргани, Питер Баккум, Питер Видани, Ричард Задорожний, Рохан Сахаи, Савелий Бондини, Шин Чанг, Вики Дуонг, Виктория Хуанг, Сяолинь Хао, Сюэцин Ли

Безопасность, системы безопасности, целостность, политика и доверие

Эбби Фанло Суск, Адам Уэллс, Алеа Хауз, Энни Чэн, Артий Сюй, Каролина Пас, Дэвид Абельман, Феми Аламу, Джей Ванг, Джеремайя Карриер, Джесика Хария, Мария Гурьева, Макс Буркхардт, Пейдж Уокер, Педро Агилар, Руцу Кошимицу, Сэм Тойзер, Саванна Хеон, Том Рубин, Тония Осадебе, Уиллоу Примак, Зои Столл

Операционное управление продуктами, программный менеджмент и управление

Антонио Ди Франческо, Филиппо Расо, Грейс Ву, Джош Метерд, Рут Костиган

Юридический отдел

Элли Беннетт, Тони Сонг, Тайс Уолтерс

Коммуникации, маркетинг, сообщество, дизайн и креатив

Акаш Айер, Алекс Бейкер-Уиткомб, Энджи Лу, Анна Обург, Антония Ричмонд, Энни Цанг, Эшли Тайра, Бейли Ричардсон, Брэндон МакГроу, Кэри Хадсон, Дана Палми, Эван Корриган, Габи Райла, Ингила Самад Али, Джеймс Андерсон, Джереми Шварц, Джордан Лисс, Хуан Гарза, Джули Стил, Кара Зичиттелла, Карн Пилунтанадилок, Кендал Пирс, Ким Баше, Лия Анис, Ливви Пирс, Мария Клара М. Флери Осорио, Минния Фенг, Ник Сиффон, Ник Форланд, Нико Феликс, Пейдж Форд, Рэйчел Пакетт, Ришаб Аггарвал, Расти Рупрехт, Суки Мансур, Тасия Потасински, Тая Кристиансон, Васундхара Мудгил, Уитни Феррис, Яра Хакабаз, Зак Брок, Зои Сильверман

Особая благодарность

Эми Янг, Арвин Ву, Авитал Оливер, Брэндон МакКинзи, Чак Ли, Крис Лу, Дэвид Дуксин, Дянь Ан Яп, Габриэль Петерссон, Гийом Леклерк, Хейзел Бирн, Генри Аспергрен, Дженнифер Ласкенбилл, Цзи Лин, Джозеф Мо, Юлиус Хохмут, Люнянь (Гарольд) Ли, Лон Оуян, Мариано Лопес, Майкл Чжан, Рави Теджа Муллапуди, Суванш Санджив, Варун Шетти, Вэнда Чжоу

Руководство

Фиджи Симо, Ханна Вонг, Якуб Пачоцкий, Джейсон Квон, Йоханнес Хайдеке, Кейт Рауч, Лорен Ито, Марк Чен, Миа Глайзе, Ник Райдер, Ник Тёрли, Прафулла Дхаривал, Сэм Альтман, Сулман Чудри

Полный текст статьи читайте на OpenAI