Модель DALL·E 3 теперь доступна в ChatGPT Plus и Enterprise

Мы разработали комплекс мер безопасности для подготовки DALL·E 3 к более широкому релизу и делимся последними новостями наших исследований в области установления происхождения контента.

Читать исследовательскую работуПосмотреть системную карту DALL·E 3
Cloud astronaut

Иллюстрация: Валери Ранум × DALL·E

DALL·E 3 в ChatGPT

Теперь ChatGPT может создавать уникальные изображения на основе простого диалога — и эта новая функция уже сегодня доступна пользователям тарифов Plus и Enterprise. Опишите то, что вы представляете, и ChatGPT воплотит вашу идею в жизнь, предложив на выбор несколько вариантов изображений для доработки и улучшения. Вы можете попросить о внесении правок прямо в чате. Функция работает на базе нашей самой продвинутой модели генерации изображений DALL·E 3.

Исследования

DALL·E 3 стала результатом многочисленных исследовательских достижений как внутри OpenAI, так и за её пределами. По сравнению со своим предшественником, DALL·E 3 генерирует изображения, которые не только выглядят более впечатляюще, но и отличаются большей чёткостью деталей. DALL·E 3 способна достоверно воспроизводить сложные детали, включая текст, руки и лица. Кроме того, модель отлично справляется с обработкой подробных и развернутых текстовых запросов (промптов) и поддерживает как альбомную, так и портретную ориентацию изображений. Эти возможности были достигнуты благодаря обучению передовой системы описания изображений (image captioner), которая создаёт более качественные текстовые описания для тренировочной базы наших моделей. Затем DALL·E 3 обучалась на этих улучшенных описаниях, в результате чего получилась модель, которая гораздо точнее следует запросам пользователя. Подробнее об этом процессе вы можете прочитать в нашей исследовательской работе.

Ответственная разработка и развертывание

Мы используем многоуровневую систему безопасности, чтобы ограничить способность DALL·E 3 генерировать потенциально вредный контент, включая сцены насилия, материалы для взрослых или разжигающие ненависть. Проверки безопасности выполняются как для пользовательских запросов, так и для получаемых изображений до того, как они будут показаны пользователям. Мы также сотрудничали с первыми пользователями и экспертами по тестированию на проникновение («красными командами»), чтобы выявить и устранить пробелы в защите наших систем безопасности, которые проявились с появлением новых возможностей модели. Например, полученные отзывы помогли нам определить граничные случаи генерации графического контента, такие как изображения сексуального характера, и провести стресс-тестирование способности модели создавать убедительно вводящие в заблуждение картинки.

В рамках работы по подготовке DALL·E 3 к внедрению мы также предприняли шаги для ограничения вероятности создания контента в стиле ныне живущих художников и изображений публичных личностей, а также для улучшения демографического представительства на сгенерированных изображениях. Подробнее о работе по подготовке DALL·E 3 к масштабному внедрению читайте в системной карте DALL·E 3.

Отзывы пользователей помогут нам продолжать совершенствоваться. Пользователи ChatGPT могут поделиться своим мнением с нашей исследовательской группой, используя значок флажка, чтобы сообщить нам о небезопасных результатах или результатах, которые неточно отражают заданный вами запрос. Прислушиваться к разнообразному и широкому сообществу пользователей и обладать пониманием реального мира критически важно для ответственной разработки и внедрения ИИ, и это лежит в основе нашей миссии.

Мы исследуем и оцениваем первую версию классификатора происхождения — нового внутреннего инструмента, который может помочь нам определить, было ли изображение сгенерировано DALL·E 3. По результатам ранних внутренних тестов, точность определения того, что изображение было создано DALL·E, составляет более 99%, если картинка не подвергалась изменениям. Точность остается выше 95%, когда изображение подвергается типичным типам модификаций (например, обрезке, изменению размера, JPEG-сжатию), а также когда текст или фрагменты реальных изображений накладываются на небольшие участки сгенерированного изображения. Несмотря на эти высокие результаты внутренних испытаний, классификатор может лишь подсказать, что изображение, вероятно, было создано DALL·E, и пока не позволяет делать окончательные выводы. Этот классификатор происхождения может стать частью комплекса методов, помогающих людям понять, создан ли аудио- или визуальный контент с помощью искусственного интеллекта. Это задача, которая потребует сотрудничества всей цепочки создания стоимости в сфере ИИ, включая платформы, распространяющие контент среди пользователей. Мы рассчитываем многое узнать о том, как работает этот инструмент и где он может быть наиболее полезен, а также со временем улучшить наш подход.

Инструменты творческого контроля

Модель DALL·E 3 настроена на отклонение запросов с просьбой создать изображение в стиле ныне живущих художников. Мы также предоставляем авторам возможность исключить свои изображения из обучения наших будущих моделей генерации изображений.

Галерея

Автор

OpenAI

Полный текст статьи читайте на OpenAI