Приложение к системной карте GPT‑4o: генерация изображений в 4o

Введение
Генерация изображений в 4o — это новый, значительно более мощный подход к созданию изображений по сравнению с нашими более ранними моделями серии DALL·E 3. Она способна создавать фотореалистичные результаты. Модель может принимать изображения на вход и преобразовывать их. Она способна следовать подробным инструкциям, включая надежное внедрение текста в изображения. И поскольку генерация изображений встроена нативно, в самую глубь архитектуры нашей омнимодальной модели GPT‑4o, она может использовать все свои знания для применения этих возможностей тонкими и выразительными способами, создавая изображения, которые не только красивы, но и полезны.
Генерация изображений в 4o использует преимущества нашей существующей инфраструктуры безопасности и опыт, полученный при развертывании DALL·E и Sora. В то же время эти новые возможности несут в себе и некоторые новые риски. В этом приложении к системной карте GPT‑4o описаны маргинальные риски, на которых мы сосредоточили внимание, и проделанная нами работа по их устранению.
Автор
Полный текст статьи читайте на OpenAI
