Обновление спецификации моделей с учетом мер защиты подростков

Опираясь на рекомендации экспертов, принципы U18 определяют, как ChatGPT должен помогать подросткам, обеспечивая безопасное и соответствующее их возрасту поведение.
Мы представляем обновление нашей спецификации моделей (Model Spec) — свода правил, ценностей и поведенческих ожиданий, который определяет, как должны вести себя наши ИИ-модели, особенно в сложных или критических ситуациях, в виде принципов для лиц младше 18 лет (U18). Поведение модели имеет решающее значение для взаимодействия людей с ИИ, а у подростков иные потребности в развитии, чем у взрослых.
Принципы U18 определяют, как ChatGPT должен обеспечивать безопасный и возрастной опыт для подростков в возрасте от 13 до 17 лет. Основанный на науке о развитии, этот подход уделяет первостепенное внимание предотвращению проблем, прозрачности и раннему вмешательству. При разработке этих принципов мы предварительно обсудили их со сторонними экспертами, включая Американскую психологическую ассоциацию, в рамках нашей постоянной работы по сбору отзывов для усиления нашего подхода.
Хотя принципы спецификации моделей по-прежнему применяются как к взрослым, так и к подросткам, это обновление уточняет, как их следует применять в контексте подростков, особенно там, где соображения безопасности несовершеннолетних могут быть более выраженными.
Принципы U18 опираются на четыре руководящих принципа:
- ставить безопасность подростков на первое место, даже если это может противоречить другим целям
- поощрять поддержку в реальном мире, стимулируя офлайн-отношения и проверенные ресурсы
- относиться к подросткам как к подросткам, не опускаясь до снисходительности и не обращаясь с ними как со взрослыми
- быть прозрачными, устанавливая четкие ожидания
В соответствии с нашей концепцией безопасности подростков, эти принципы до сих пор определяли нашу работу по обеспечению безопасности подростков, включая средства защиты контента, которые мы применяем к пользователям, сообщившим при регистрации о своем возрасте до 18 лет, а также через родительский контроль. В этих контекстах мы внедрили средства защиты, чтобы побуждать модель проявлять особую осторожность при обсуждении зон повышенного риска, включая самоповреждение и суицид, романтические или сексуализированные ролевые игры, графический или откровенный контент, опасные виды деятельности и вещества, проблемы с обращением с собственным телом и расстройства пищевого поведения, а также просьбы скрывать информацию об опасном поведении.
Американская психологическая ассоциация, которая изучила ранний проект спецификации моделей для лиц младше 18 лет и предложила важные долгосрочные идеи, четко заявляет о важности защиты подростков:
»APA призывает разработчиков ИИ предлагать меры предосторожности, соответствующие возрасту молодых пользователей их продуктов, и применять более защитный подход к более молодым пользователям. Дети и подростки могут извлечь пользу из инструментов ИИ, если они сочетаются с человеческим общением, которое, как показывает наука, имеет решающее значение для социального, психологического, поведенческого и даже биологического развития. Опыт взаимодействия молодежи с ИИ должен тщательно контролироваться и обсуждаться с заслуживающими доверия взрослыми, чтобы поощрять критический анализ того, что предлагают боты ИИ, а также способствовать развитию у молодежи навыков и самостоятельного мышления.»—Д-р Артур К. Эванс-младший (Dr. Arthur C. Evans Jr), генеральный директор Американской психологической ассоциации
Это обновление также уточняет, как ассистент должен реагировать при возникновении проблем с безопасностью у подростков. Это означает, что подростки будут сталкиваться с более строгими ограничениями, более безопасными альтернативами и призывами обращаться за проверенной офлайн-поддержкой, когда беседы переходят в область повышенного риска. При наличии неизбежного риска подросткам настоятельно рекомендуется связаться с экстренными службами или кризисными центрами.
Как и остальная часть спецификации моделей, принципы U18 отражают наше видение желаемого поведения модели. Мы продолжим совершенствовать их по мере интеграции новых исследований, мнений экспертов и опыта реального использования.
Развитие нашей работы по повышению безопасности подростков
Наряду с обновлением спецификации моделей мы применили многоуровневый подход к повышению безопасности подростков в ChatGPT, охватывающий средства защиты продуктов, поддержку семей и рекомендации экспертов.
С момента запуска родительского контроля мы распространили средства защиты на новые продукты, включая групповые чаты, браузер ChatGPT Atlas и приложение Sora. Эти обновления помогают родителям настраивать использование ChatGPT своими подростками по мере появления новых продуктов и функций.
В соответствии с рекомендациями экспертов мы поощряем постоянные беседы между родителями и подростками о здоровом и ответственном использовании ИИ в их семье. Чтобы поддержать эти беседы, мы добавили новые проверенные экспертами ресурсы в центр ресурсов для родителей, включая Семейное руководство по помощи подросткам в ответственном использовании ИИ и советы для родителей о том, как говорить со своими детьми об ИИ. Эти материалы были проверены организацией ConnectSafely и членами нашего Экспертного совета по вопросам благополучия и ИИ. Мы продолжим добавлять новые ресурсы с течением времени. Мы также поддерживаем здоровое использование непосредственно в продукте с помощью встроенных напоминаний о перерывах во время долгих сеансов, чтобы время, проведенное в ChatGPT, было осознанным и сбалансированным.
Работа с экспертами
Наша работа в области безопасности подростков основана на тесном взаимодействии с экспертами из различных дисциплин и областей знаний. В октябре мы создали Экспертный совет по вопросам благополучия и ИИ, чтобы он помогал консультировать и определять, каким должно быть здоровое взаимодействие с ИИ для всех возрастов. Эта работа легла в основу рекомендаций по родительскому контролю и уведомлениям для родителей. Мы также привлекаем клинических экспертов через нашу глобальную сеть врачей для проведения исследований безопасности и оценки поведения моделей, включая улучшение того, как ChatGPT распознает стресс и при необходимости направляет людей к профессиональной помощи. Мы заложили эти основы в GPT‑5.2, а также расширили доступ к реальной поддержке, добавив локализованные телефоны доверия в ChatGPT и Sora благодаря нашему партнерству с ThroughLine.
Что дальше
Мы находимся на начальном этапе внедрения модели прогнозирования возраста в потребительские тарифные планы ChatGPT. Это поможет нам автоматически применять средства защиты подростков, когда мы считаем, что учетная запись принадлежит несовершеннолетнему. Если мы не уверены в чьем-то возрасте или имеем неполную информацию, мы по умолчанию будем использовать интерфейс для лиц младше 18 лет и предоставим взрослым способы подтвердить свой возраст.
Повышение безопасности подростков — это постоянная работа, и мы продолжим совершенствовать родительский контроль и возможности моделей, расширять ресурсы для родителей, а также сотрудничать с организациями, исследователями и экспертами-партнерами, включая Совет по благополучию и Глобальную сеть врачей.
Мы стремимся создать надежные средства защиты подростков и со временем совершенствовать их, чтобы лучше поддерживать подростков и их семьи.
Автор
Полный текст статьи читайте на OpenAI
