Представляем нашу новейшую модель генерации изображений в API

Когда в прошлом месяце мы представили функцию генерации изображений в ChatGPT, она быстро стала одной из наших самых популярных возможностей: более 130 миллионов пользователей по всему миру создали свыше 700 миллионов изображений всего за первую неделю.
Сегодня мы переносим исходно мультимодальную модель, которая обеспечивает эту работу в ChatGPT, в API через gpt-image-1, что позволяет разработчикам и компаниям легко интегрировать высококачественную профессиональную генерацию изображений непосредственно в свои собственные инструменты и платформы. Универсальность модели позволяет ей создавать изображения в самых разных стилях, точно следовать пользовательским инструкциям, использовать знания о мире и аккуратно отрисовывать текст — открывая бесчисленные практические возможности в самых разных сферах.
Ведущие предприятия и стартапы в таких отраслях, как создание творческих инструментов, электронная коммерция, образование, корпоративное ПО и гейминг, уже используют генерацию изображений в своих продуктах и решениях. Мы рады поделиться некоторыми из таких примеров ниже.
Мы также продолжаем работать с разработчиками и бизнесом над поиском новых способов применения генерации изображений в API для их задач, в том числе:
Дизайн и редактирование: Canva изучает возможности интеграции gpt-image-1 от OpenAI, чтобы раздвинуть границы генерации и редактирования дизайна в своих инструментах Canva AI и Magic Studio. Благодаря возможностям gpt-image-1, таким как превращение грубых эскизов в потрясающие графические элементы и высокоточное визуальное редактирование, Canva поможет еще 230 миллионам своих пользователей воплощать идеи в жизнь совершенно новыми способами.
Создание и редактирование логотипов: GoDaddy активно экспериментирует с интеграцией генерации изображений, чтобы клиенты могли легко создавать редактируемые логотипы, удалять фоны и генерировать профессиональную типографику. Кроме того, в рамках нового пользовательского опыта с GoDaddy Airo® команда работает над тем, чтобы клиенты могли создавать посты для соцсетей и маркетинговые материалы, отражающие их уникальную индивидуальность бренда для оригинального контента продуктов и брендов на основе текстового запроса.
Создание маркетинговых материалов: HubSpot изучает, как новые возможности генерации изображений с помощью ИИ от OpenAI могут помочь клиентам создавать маркетинговые и коммерческие материалы. По мере того как HubSpot продолжает добавлять новые инструменты на базе ИИ для масштабирования бизнеса, эти возможности генерации изображений способны трансформировать то, как клиенты создают высококачественные изображения для социальных сетей, почтового маркетинга и целевых страниц без необходимости привлечения профильных экспертов по дизайну.
Генерация рецептов и списков покупок: Instacart тестирует новые способы использования API для генерации изображений, включая иллюстрации для рецептов и списков покупок.
Редактирование видео: invideo позволяет миллионам пользователей превращать свои идеи в видео с помощью ИИ. Благодаря интеграции gpt-image-1 платформа теперь предлагает улучшенную генерацию текста, элементы точного контроля редактирования и расширенное управление стилями.
Безопасность
Модель gpt-image-1в API использует те же средства защиты, что и генерация изображений 4o в ChatGPT, включая защитные механизмы, которые ограничивают создание моделью вредоносных изображений, а также включение метаданных C2PA в сгенерированные изображения — подробнее об этом вы можете прочитать в нашей прошлой публикации в блоге здесь. Кроме того, разработчики могут управлять чувствительностью модерации с помощью параметра `moderation`, для которого можно установить значение auto (по умолчанию) для стандартной фильтрации или low для менее строгой фильтрации. Узнайте больше в нашей документации.
По умолчанию мы никогда не используем клиентские данные API для обучения, и все входные и выходные данные изображений по-прежнему подпадают под действие наших правил использования API.
Цены
Использование gpt-image-1 тарифицируется за токен, причем расценки для текстовых и графических токенов разделены:
- Токены текстового ввода (текст запроса): $5 за 1 млн токенов
- Токены ввода изображений (входные изображения): $10 за 1 млн токенов
- Токены вывода изображений (сгенерированные изображения): $40 за 1 млн токенов
На практике это означает примерно $0.02, $0.07 и $0.19 за сгенерированное квадратное изображение низкого, среднего и высокого качества соответственно. Подробные цены в зависимости от качества и размера изображения см. в документации.
Начало работы
Модель gpt-image-1 теперь доступна по всему миру через API изображений, а поддержка в Responses API появится в ближайшее время. Некоторым разработчикам может потребоваться пройти верификацию своей организации перед началом использования модели. Пожалуйста, проверьте настройки организации, чтобы узнать, есть ли у вас уже доступ.
Чтобы начать работу, изучите возможности модели в playground и ознакомьтесь с нашим руководством по генерации изображений. Мы с нетерпением ждем возможности увидеть, что вы создадите.
Авторы
Полный текст статьи читайте на OpenAI
