Интеллектуальная свобода по дизайну

ChatGPT создан полезным, надежным и адаптируемым, чтобы вы могли настроить его под себя.

Soft abstract gradient in warm orange and yellow tones with hints of green, creating a blurred, dreamy background.

Миллионы людей по всему миру ежедневно используют ChatGPT. Самая частая причина, по которой люди обращаются к нему, проста: учиться. Поскольку искусственный интеллект становится не только мощнее, но и шире применяется в самых разных культурах, профессиях и политических взглядах, критически важно, чтобы эти инструменты поддерживали интеллектуальную свободу. Это означает помощь людям в том, чтобы задавать собственные вопросы, следовать собственным рассуждениям и самим принимать решения.

В OpenAI мы создаем ChatGPT так, чтобы он отражал эти ценности: по умолчанию он является объективным, предлагает надежные элементы управления для пользователя и опирается на прозрачные принципы, определяющие поведение модели.

Объективность по умолчанию

Мы считаем, что по умолчанию ChatGPT должен быть объективным, особенно в темах, затрагивающих конкурирующие политические, культурные или идеологические точки зрения. Цель состоит не в том, чтобы предложить единственный ответ, а в том, чтобы помочь пользователям изучить различные перспективы.

Мы также сделали наши внутренние рекомендации общедоступными, чтобы каждый мог лично убедиться, как мы подходим к таким ситуациям. Наша спецификация модели (Model Spec) излагает ценности, которые мы закладываем в систему, включая приверженность полезности, безопасности, нейтральности и интеллектуальной свободе. Если ChatGPT отвечает так, что это кажется странным, спецификация модели помогает прояснить, является ли такое поведение намеренным и почему.

Поддержание интеллектуальной свободы

Один из ключевых принципов спецификации модели — интеллектуальная свобода: убеждение в том, что люди должны иметь возможность использовать ИИ для изучения идей, включая спорные или сложные, без навязывания определенного мировоззрения.

Это не значит, что дозволено абсолютно всё. Модель обучена избегать причинения вреда, нарушения конфиденциальности или помощи в опасной деятельности. Но когда речь заходит об изучении сложных или деликатных тем, ChatGPT спроектирован так, чтобы быть открытым, вдумчивым и отзывчивым —, а не нравоучительным или закрытым. Он также задуман как партнерский инструмент: он не должен просто повторять вашу точку зрения или одобрять всё, что вы говорите.

Мы понимаем, что этот баланс требует аккуратности. Слишком сильная осторожность может ограничить исследования; избыток собственного мнения может восприниматься как превышение полномочий. Мы постоянно совершенствуем то, как модель справляется с такими моментами, чтобы точнее передавать этот нюанс.

Настройка под вашим контролем

Хотя объективность является стандартом по умолчанию, мы понимаем, что здесь не существует универсального решения. Люди приходят в ChatGPT с разными целями и контекстами, и иногда они хотят адаптировать этот опыт.

Используете ли вы ChatGPT в повседневной жизни или внедряете его в свою организацию, мы считаем, что он должен настраиваться под ваши потребности. Этой весной мы представили новые настройки, которые упрощают персонализацию ChatGPT за счет регулировки тона, задания инструкций или определения того, как должны звучать ответы.

Учителю могут потребоваться четкие объяснения и источники. Воспитателю или опекуну — эмпатия и поддержка. Одни пользователи предпочитают осторожность, другие — прямоту. Эти элементы управления не меняют факты, но они помогают настроить то, как именно эти факты преподносятся, делая ChatGPT более полезным в самых разных ситуациях.

Оценка нашей работы для дальнейшего улучшения

Добиться правильного результата — это непрерывный процесс, и мы делаем это не в одиночку.

В течение последних нескольких месяцев мы проводили сессии обратной связи с пользователями и организациями гражданского общества из различных политических кругов, чтобы лучше понять, как ChatGPT проявляет себя в реальных диалогах. Эти встречи помогли выявить пробелы, лучше понять ожидания пользователей и повлиять на то, как мы будем оценивать поведение модели в дальнейшем.

Мы также запустили новую инициативу по улучшению методов оценки политической предвзятости и объективности. Традиционные оценки — тесты, проводимые для проверки ответов модели по определенной шкале — не обязательно отражают то, как люди на самом деле используют ChatGPT. Большинство пользователей не просят ChatGPT выбрать вариант в тестах с множественным выбором и даже не задают напрямую вопросы о его убеждениях. Поэтому мы разрабатываем новые критерии оценки, созданные специально для выявления политической предвзятости на основе повседневного использования: того, как люди задают вопросы, изучают идеи и учатся. Это даст нам более четкое понимание того, как баланс, точность и надежность выглядят на практике, а не только в теории.

Оценка предвзятости сложна и требует деликатного подхода; мы не рассчитываем решить все вопросы в изоляции. Мы приветствуем отзывы и вскоре поделимся подробностями о нашем подходе, который, как мы надеемся, окажется полезным для других участников экосистемы ИИ, работающих над этой же задачей.

Автор

OpenAI

Полный текст статьи читайте на OpenAI