Приверженность OpenAI обеспечению безопасности детей: внедрение принципов безопасности на этапе разработки
Мы присоединяемся к Thorn, All Tech Is Human и другим ведущим компаниям в стремлении предотвратить неправомерное использование генеративного ИИ для совершения, распространения и дальнейшего причинения вреда сексуального характера в отношении детей.

OpenAI наряду с такими лидерами индустрии, как Amazon, Anthropic, Civitai, Google, Meta, Metaphysic, Microsoft, Mistral AI и Stability AI, взяла на себя обязательство внедрять надежные меры безопасности детей при разработке, развертывании и обслуживании технологий генеративного ИИ в соответствии с принципами обеспечения безопасности на этапе разработки (Safety by Design). Эта инициатива, возглавляемая организацией Thorn, которая занимается защитой детей от сексуального насилия, и организацией All Tech Is Human, нацеленной на решение сложных проблем на стыке технологий и общества, направлена на снижение рисков, которые генеративный ИИ представляет для детей. Приняв комплексные принципы безопасности на этапе разработки, OpenAI и наши партнеры гарантируют, что безопасность детей ставится во главу угла на каждом этапе создания искусственного интеллекта. На сегодняшний день мы приложили значительные усилия, чтобы минимизировать способность наших моделей генерировать контент, наносящий вред детям, установили возрастные ограничения для ChatGPT, а также активно сотрудничаем с Национальным центром по делам пропавших и эксплуатируемых детей (NCMEC), Tech Coalition и другими государственными и отраслевыми заинтересованными сторонами по вопросам защиты детей и совершенствования механизмов подачи жалоб.
В рамках реализации принципов безопасности на этапе разработки мы берем на себя следующие обязательства:
- Разработка: Разрабатывать, создавать и обучать модели генеративного ИИ с упреждающим учетом рисков для безопасности детей.
- Ответственно подходить к формированию обучающих наборов данных, выявлять и удалять материалы с изображениями сексуального насилия над детьми (CSAM) и материалы сексуальной эксплуатации детей (CSEM) из тренировочных данных, а также сообщать о любых подтвержденных случаях CSAM в соответствующие органы.
- Внедрять механизмы обратной связи и стратегии итеративного стресс-тестирования в наш процесс разработки.
- Применять решения для противодействия неправомерному использованию со стороны злоумышленников.
- Развертывание: Выпускать и распространять модели генеративного ИИ после их обучения и оценки на предмет безопасности детей, обеспечивая защиту на всех этапах процесса.
- Бороться с оскорбительным контентом и недопустимым поведением, реагировать на них, а также внедрять превентивные меры.
- Поощрять ответственность разработчиков в вопросах безопасности с момента проектирования.
- Обслуживание: Поддерживать безопасность моделей и платформы, продолжая активно отслеживать риски для безопасности детей и реагировать на них.
- Обязательство удалять с нашей платформы новые материалы CSAM, сгенерированные с помощью искусственного интеллекта злоумышленниками.
- Инвестировать в исследования и перспективные технологические решения.
- Бороться с CSAM, сгенерированными с помощью ИИ материалами CSAM и CSEM на наших платформах.
Данное обязательство знаменует собой важный шаг в предотвращении неправомерного использования технологий ИИ для создания или распространения материалов сексуального насилия над детьми, созданных с помощью ИИ (AIG-CSAM), и других форм сексуального вреда в отношении детей. В рамках рабочей группы мы также договорились ежегодно публиковать отчеты о достигнутом прогрессе.
«Мы глубоко заботимся о безопасности и ответственном использовании наших инструментов, поэтому мы заложили мощные защитные механизмы и меры безопасности в ChatGPT и DALL-E. Мы стремимся работать бок о бок с Thorn, All Tech is Human и всем технологическим сообществом, чтобы отстаивать принципы безопасности на этапе разработки и продолжать нашу работу по минимизации потенциального вреда для детей».
Это совместное действие подчеркивает наш общий подход к безопасности детей, демонстрируя общую приверженность этичным инновациям и благополучию наиболее уязвимых членов общества. Организация Thorn опубликовала данные принципы на сайте https://teamthorn.co/gen-ai
Связанные исследования

Публикация31 янв. 2024 г.

Безопасность14 дек. 2023 г.

Публикация14 дек. 2023 г.
Полный текст статьи читайте на OpenAI
