Повышение надежности происхождения контента для создания более безопасной и прозрачной экосистемы ИИ

Помогаем людям понять происхождение созданного ИИ контента с помощью Content Credentials, SynthID и раннего инструмента публичной верификации.

Попробовать наш инструмент

Обновление от 31 июля 2026 г.: Мы расширяем эту работу за пределы изображений. Поддерживаемые аудиофайлы, созданные с помощью инструментов OpenAI (включая ChatGPT и OpenAI API), теперь включают водяные знаки SynthID. Наш инструмент публичной верификации теперь позволяет проверять поддерживаемые аудиофайлы наряду с изображениями. Мы также внедряем API-доступ для верификации, чтобы разработчики и организации могли встраивать проверки происхождения в свои собственные рабочие процессы. В совокупности эти обновления дополняют многоуровневый подход, описанный ниже: сочетание открытых стандартов, таких как C2PA, устойчивых сигналов цифровых водяных знаков, таких как SynthID, а также инструментов проверки, которые упрощают обнаружение и использование информации о происхождении для все большего числа типов контента, созданного OpenAI.

Люди ежедневно используют инструменты OpenAI для создания и редактирования изображений и аудио способами, которые делают общение более выразительным, полезным и доступным. Поскольку эти инструменты становятся частью того, как люди создают, представляют и делятся информацией, важно, чтобы они могли понимать и проверять происхождение медиафайлов, чтобы интерпретировать их с большей уверенностью. Сигналы происхождения могут помочь, предоставляя пользователям контекст о том, откуда взялся контент, как он был создан или отредактирован и соответствует ли он тому, за что себя выдает.

Сегодня мы укрепляем наш подход к происхождению контента с помощью многоуровневой модели, ориентированной на экосистему, для построения доверия в интернете. Мы делаем наши сигналы происхождения более узнаваемыми для других инструментов и платформ за счет соответствия стандарту C2PA, добавляем устойчивые кроссплатформенные водяные знаки SynthID к изображениям благодаря партнерству с Google, а также делимся предварительной версией инструмента, который общественность может использовать для проверки того, были ли изображения созданы OpenAI.

В совокупности эти обновления развивают нашу предыдущую работу по поддержке открытых стандартов, упрощению идентификации созданного OpenAI контента и сотрудничеству в масштабах всей отрасли в целях формирования более надежной информационной экосистемы.

Построение экосистемы доверия посредством соответствия стандарту C2PA

Компания OpenAI участвует в разработке и внедрении стандартов происхождения с 2024 года, когда мы начали добавлять учетные данные контента (Content Credentials) к изображениям, созданным с помощью DALL·E 3, а позднее — ImageGen и Sora. Мы также вошли в Руководящий комитет Коалиции за происхождение и подлинность контента (C2PA) — межотраслевой группы, стоящей за созданием открытого технического стандарта происхождения контента. Технический подход C2PA использует метаданные и криптографические подписи, чтобы информация о медиафайле безопасно передавалась вместе с самим контентом. Эта информация включает в себя контекст, который помогает журналистам при оценке источника, платформам при принятии решений об информационной целостности, а также обычным людям, пытающимся понять, что именно они видят в сети.

Недавно мы сделали шаг вперед, превратив OpenAI в продукт-генератор, соответствующий стандарту C2PA. Став соответствующими требованиям C2PA, мы предоставляем платформам надежный способ чтения, сохранения и передачи информации о происхождении, которую мы прикрепляем к нашему контенту. Это имеет решающее значение, поскольку отслеживание происхождения работает только тогда, когда данные сохраняются за пределами первой платформы создания контента, и соответствие стандартам делает это возможным.

Многоуровневый подход к происхождению контента с использованием Google SynthID для изображений

Метаданные C2PA служат важной основой для определения происхождения. Они помогают контенту содержать информацию о том, откуда он взялся, как был создан или отредактирован и кто подписал эту информацию. Однако метаданные не идеальны. Их можно удалить, потерять при загрузке и выгрузке либо повредить в результате трансформаций, таких как изменение формата файла, масштабирование или создание скриншотов.

Чтобы сделать отслеживание происхождения более надежным, мы применяем многоуровневый подход и внедряем водяные знаки с помощью Google DeepMind SynthID, начиная с изображений, созданных через ChatGPT, Codex или OpenAI API. SynthID внедряет невидимый слой водяных знаков, который дополняет подходы на основе метаданных C2PA.

Мы шли к этому на протяжении некоторого времени. Мы использовали видимые водяные знаки в Sora и аудиоводяной знак в Voice Engine, а также продолжали тестировать и исследовать их точность и надежность в процессе развертывания.

Эти две системы взаимно усиливают друг друга. C2PA помогает контенту переносить подробный контекст; SynthID помогает сохранить сигнал, если метаданные не уцелели. Водяные знаки могут быть более устойчивыми к таким преобразованиям, как создание скриншотов, в то время как метаданные способны предоставить больше информации, чем один лишь водяной знак. Вместе они делают происхождение контента более защищенным, чем любой из этих уровней по отдельности.

Diagram comparing two image provenance signals: C2PA adds signed metadata that can be validated to confirm a trusted OpenAI issuer, while SynthID embeds a pixel-level signal that can be detected to indicate whether an image was encoded by OpenAI.

Обнаружение и предварительный просмотр нашего инструмента публичной верификации

Надежные метаданные и водяные знаки, устойчивые к большинству модификаций, могут сделать сигналы происхождения более долговечными. Однако людям необходим способ обнаружения этих сигналов. Мы представляем предварительную версию инструмента публичной верификации, который поможет пользователям проверять, было ли загруженное изображение создано в ChatGPT, OpenAI API или Codex, путем проверки наличия сигналов происхождения, включая Content Credentials и SynthID.

Мы убеждены, что информацию о происхождении должно быть проще проверять и интерпретировать, и что наш инструмент поможет людям ответить на вопрос: «Сгенерировано ли это с помощью ИИ?» — путем интеграции нескольких сигналов. Это решение опирается на выводы, полученные в ходе первичного исследовательского превью нашего классификатора обнаружения изображений в 2024 году, и позволяет пользователям надежно определять наличие в медиафайлах водяного знака SynthID от OpenAI, а также выводить на экран метаданные C2PA при их обнаружении.

OpenAI webpage showing a verification result for an uploaded image, confirming it was generated with OpenAI tools based on detected SynthID and Content Credentials signals.

Ни один метод обнаружения не является абсолютно безотказным, поэтому мы подходим к делу с осторожностью в случаях, когда определение не удается. Например, если метаданные или водяные знаки не обнаружены, инструмент не будет делать окончательных выводов о том, было ли изображение создано с помощью инструментов OpenAI, поскольку в некоторых случаях сигналы происхождения могут быть удалены.

На момент запуска инструмент ограничивается контентом, созданным OpenAI. В ближайшие месяцы мы планируем поддержать межотраслевые инициативы, чтобы сделать верификацию возможной на разных платформах. Со временем мы также рассчитываем добавить поддержку новых типов контента, с которыми пользователи могут столкнуться в интернете.

Взгляд в будущее

Ни один отдельный метод определения происхождения не достаточен сам по себе. Мы верим, что эффективный подход сочетает в себе общие стандарты, устойчивые сигналы водяных знаков и публичную верификацию. Опираясь на нашу многолетнюю поддержку Content Credentials, внедряя стандарты C2PA, принимая SynthID и представляя превью инструментов публичной верификации, мы надеемся внести долгосрочный вклад в формирование более совместимой экосистемы происхождения контента.

Автор

OpenAI

Полный текст статьи читайте на OpenAI