Регулирование передовых систем ИИ: управление возникающими рисками для общественной безопасности

Аннотация
Современные модели искусственного интеллекта открывают огромные перспективы для человечества, однако общество должно упреждающе управлять сопутствующими рисками. В этой статье мы сосредоточимся на том, что мы называем «передовыми моделями ИИ» (frontier AI): высокопроизводительных базовых моделях, которые могут обладать опасными возможностями, достаточными для создания серьезных угроз общественной безопасности. Передовые модели ИИ ставят перед регулированием уникальные задачи: опасные возможности могут возникать неожиданно; чрезвычайно сложно надежно предотвратить ненадлежащее использование развернутой модели; кроме того, трудно остановить широкое распространение возможностей модели. Для решения этих задач необходимы как минимум три структурных элемента регулирования передовых моделей: (1) процессы стандартизации для определения надлежащих требований к разработчикам передового ИИ, (2) требования к регистрации и отчетности для обеспечения видимости процессов разработки передового ИИ для регуляторов, и (3) механизмы обеспечения соблюдения стандартов безопасности при разработке и развертывании передовых моделей ИИ. Саморегулирование индустрии — это важный первый шаг. Тем не менее, для создания стандартов и обеспечения их соблюдения потребуются более широкие общественные дискуссии и вмешательство государства. Мы рассматриваем несколько вариантов решения этой задачи, включая наделение контрольных органов правомочиями по принудительному исполнению и введение режима лицензирования для передовых моделей ИИ. Наконец, мы предлагаем базовый набор стандартов безопасности. К ним относятся проведение оценки рисков до развертывания; внешний контроль за поведением модели; использование оценок рисков при принятии решений о развертывании;, а также мониторинг новой информации о возможностях и сценариях использования модели после ее развертывания и реагирование на нее. Мы надеемся, что это обсуждение внесет свой вклад в более широкую дискуссию о том, как сбалансировать риски для общественной безопасности и инновационные выгоды от достижений на переднем крае разработки ИИ.
Авторы отчета в алфавитном порядке
Маркус Андерльюнг (Центр управления ИИ; Центр новой американской безопасности) *†Джослин Барнхарт (Google DeepMind) **Джейд Люн (OpenAI) *Антон Коринек (Институт Брукингса; Университет Вирджинии; Центр управления ИИ) **†Каллен О'Киф (OpenAI) *Джесс Уиттлстоун (Центр долгосрочной устойчивости) **
Авторы отчета в алфавитном порядке
Шахар Авин (Центр изучения экзистенциальных рисков Кембриджского университета)Майлз Брандадж (OpenAI)Джастин Баллок (Университет Вашингтона; Аналитический центр Convergence Analysis)Данкан Касс-Беггс (Центр инноваций в международном управлении)Бен Чанг (Фонд Эндрю В. Маршалла)Тантум Коллинз (Сетевое объединение GETTING-Plurality, Центр этики им. Эдмонда и Лили Сафры при Гарвардском университете)Тим Фист (Центр новой американской безопасности)Джиллиан Хадфилд (Университет Торонто; Векторный институт; OpenAI)Алан Хейс (Akin Gump Strauss Hauer & Feld LLP)Льюис Хо (Google DeepMind)Сара Хукер (Cohere For AI)Эрик Хорвиц (Microsoft)Ноам Колт (Университет Торонто)Йонас Шутт (Центр управления ИИ)Йонадав Шавит (Гарвардский университет) ***Дивья Сиддарт (Проект коллективного интеллекта)Роберт Трагер (Центр управления ИИ; Калифорнийский университет в Лос-Анджелесе)Кевин Вольф (Akin Gump Strauss Hauer & Feld LLP)
Перечисленные авторы внесли существенный вклад в виде идей и/или работы над белой книгой. Вклад включает в себя написание текста, редактирование, исследование, подробные отзывы и участие в семинаре по проекту документа. Учитывая размер группы, включение в качестве автора не означает одобрения всех утверждений в документе, а также не означает одобрения со стороны организации какого-либо из авторов.
*Существенный вклад, включая написание текста, исследование, организацию встреч и определение направления работы над документом.
**Существенный вклад, включая редактирование, организацию встреч, детальные комментарии и определение направления работы над документом.
***Работа выполнена в период сотрудничества с OpenAI в качестве независимого подрядчика.†Авторы, ответственные за переписку. Маркус Андерльюнг (markus.anderljung@governance.ai) и Антон Коринек (akorinek@brookings.edu).
Полный текст статьи читайте на OpenAI
