Период формирования политики в сфере ИИ открыт. Нам нужно действовать.

6j6yjkcvdffsmjbvq2uw8u-seo__1_.png?w=160

Автор: Крис Лехайн (Chris Lehane), директор по глобальным делам OpenAI

Мы вступили в новую главу возможностей ИИ, и это требует новой главы для политики в сфере ИИ. Ни одна компания, ни одна отрасль или правительство не смогут справиться с этим вызовом в одиночку. Нам необходимо ответить на этот вызов, отдав предпочтение решительным действиям в ущерб безупречности политических формулировок.

Вот что мы предпринимаем:

  1. Продвижение обязательных национальных требований по безопасности ИИ. Мы хотим работать с Конгрессом над обязательным национальным регулированием безопасности ИИ, основанным на оценке возможностей.
  2. Сохранение динамики на уровне штатов. До тех пор пока Конгресс не примет меры, мы продолжим поддерживать законодательные инициативы штатов, которые укрепляют общую экосистему безопасности ИИ. Сегодня мы объявляем о поддержке четырех законопроектов в Калифорнии: SB 813, касающегося общей инфраструктуры для независимых оценок безопасности, AB 1405 — стандартов для аудиторов ИИ, SB 1119 — защиты молодежи, и AB 1864 — мер предосторожности против биологических угроз, создаваемых с помощью ИИ.
  3. Развитие стандартов, определяемых отраслью. Мы будем сотрудничать с другими передовыми лабораториями в деле продвижения стандартов передового ИИ, формируя добровольные инициативы уже сейчас, независимо от наличия или отсутствия государственной поддержки.
  4. Создание глобальных стандартов. Мы будем выступать за совместимые международные подходы к оценке возможностей, управлению рисками, сохранению контроля со стороны человека и определению того, когда и как развитие должно быть замедлено или остановлено, даже если это означает замедление темпов роста возможностей моделей.

Наш главный научный сотрудник Якуб Пачоцкий (Jakub Pachocki) недавно написал, что стремительный рост машинного интеллекта, включая потенциал рекурсивного самосовершенствования, требует «предельной осторожности». OpenAI продолжит искать технические решения для проблемы выравнивания (alignment) и мониторинга, создавать оборонительные системы и замедлять разработку в случае необходимости. Однако технической работы внутри отдельных лабораторий будет недостаточно. Нам также необходимы общие стандарты, в том числе касающиеся того, когда разработку следует замедлить или остановить.

Цена вопроса огромна. Передовой ИИ может ускорить разработку новых лекарств, укрепить критическую инфраструктуру, расширить экономические возможности и помочь в решении научных проблем, которые сопротивлялись усилиям поколений людей. Но возможности, делающие модели более полезными, несут в себе и риски, и они не останутся ограничены лишь несколькими передовыми лабораториями. Модели, разрабатываемые по всему миру, включая модели с открытым исходным кодом, будут все ближе подбираться к сегодняшнему передовому рубежу и станут широко доступными.

Возможности Astra, первые свидетельства ускорения исследований с помощью ИИ и эссе Якуба указывают на одно и то же: ИИ развивается быстро, и политика должна двигаться с ним в ногу.

Грег Брокман (Greg Brockman) описал концепцию «окна защитников»: ограниченный период времени, в течение которого передовой ИИ может помочь защитникам укрепить критически важные системы до того, как мощные наступательные возможности станут повсеместными. Законодатели сталкиваются с аналогичным моментом: закрывающимся окном возможностей для создания долговечных мер безопасности до того, как возможности ИИ опередят институты, отвечающие за их регулирование.

По мере роста возможностей уверенность в безопасности должна все в большей степени задавать темп прогресса в сфере ИИ. Безопасность не стоит на пути прогресса; она и есть то, что позволяет прогрессу идти дальше и приносить пользу бóльшему количеству людей.

Мы усилили мониторинг, выравнивание и меры безопасности на протяжении всего жизненного цикла разработки моделей, включая более надежную изоляцию рабочих нагрузок передовых исследований, расширенный мониторинг поведения моделей во время обучения и оценок с использованием инструментов, а также более четкие правила эскалации опасений. Для Astra мы также внедрили универсальный мониторинг полных траекторий, включая цепочки рассуждений (chains of thought), и обязательный барьер оценки выравнивания перед более широким внутренним развертыванием.

Эти меры безопасности должны и дальше опережать развитие возможностей. Если продолжение работы будет создавать неприемлемый риск для безопасности, мы замедлим или остановим разработку или развертывание систем, которые не можем в достаточной мере обезопасить, как мы уже делали ранее и как того требует наша методология готовности (preparedness framework).

Подготовка к рекурсивному самосовершенствованию

Полностью автономное рекурсивное самосовершенствование — при котором системы ИИ самостоятельно управляют последующими поколениями еще более способного ИИ — сегодня не происходит. Мы не должны стремиться к нему до тех пор, пока это не удастся делать безопасно.

Тем не менее, ИИ уже ускоряет часть исследований, используемых для разработки и выравнивания следующего поколения моделей. Наше последнее исследование показывает, что агенты ИИ могут выполнять некоторые задачи, на которые у квалифицированных исследователей уходят дни. Это еще не рекурсивное самосовершенствование, но это свидетельство направления движения.

Это ускорение может и должно быть направлено также на обеспечение безопасности. Наша цель — безопасно создавать автоматизированных исследователей ИИ, которые работают под наблюдением человека для продвижения как глубокого обучения, так и выравнивания, используя каждое поколение ИИ для того, чтобы сделать следующее поколение более безопасным, согласованным и легко управляемым, а не просто более мощным.

Правительства должны разработать общие способы измерения этого прогресса, сохранения содержательного контроля со стороны человека и установления общих стандартов безопасности в отношении того, когда и как развитие должно быть замедлено или остановлено. Если мы не можем достичь определенных уровней безопасности без замедления роста возможностей, мы должны отдать приоритет первому. Чем мощнее становится технология, тем сильнее должны становиться сопутствующие меры безопасности.

Совместная работа с Конгрессом над обязательными национальными требованиями безопасности ИИ

Перспектива ускоренного ИИ развития требует большего, чем добровольные обязательства. Соединенным Штатам необходимо обязательное национальное регулирование, основанное на оценке возможностей, способное развиваться вместе с технологией.

Наша Концепция демократического управления передовым ИИ задает путь к долговечной федеральной структуре: общие требования к тестированию и независимой оценке, усиленная защита кибербезопасности, четкие правила отчетности об инцидентах, повышенная национальная готовность и общие меры по отслеживанию прогресса на пути к рекурсивному самосовершенствованию.

В настоящее время в Конгрессе формируется несколько серьезных предложений по безопасности передового ИИ. Мы продолжим конструктивный диалог и рассчитываем поддержать законодательство, которое существенно повышает планку безопасности. При столь высоких ставках мы не можем позволить стремлению к идеалу стать врагом хорошего. Конгресс должен действовать до того, как уйдет на перерыв.

Национальная структура должна быть надежной, но тщательно сфокусированной. Требования к безопасности передовых разработок должны применяться к горстке хорошо обеспеченных ресурсами лабораторий, создающих самые мощные системы, а не к стартапам, небольшим разработчикам или исследователям, работающим вдали от переднего края. Обязательства должны быть соразмерны возможностям и рискам.

Политика в отношении передовой безопасности также не должна превратиться в политику открытых весов (open-weights) под другим названием. Открытые модели могут быть частью решения, особенно в области кибербезопасности и там, где потребности суверенитета, безопасности или локализации данных благоприятствуют развертыванию на местах. Большинство конкурируют не на передовом крае, а по стоимости, контролю и задержке. Как мы подтвердили, подписав письмо об открытых весах и лидерстве США в сфере ИИ, Америке нужны как открытые, так и закрытые модели. Федеральная структура должна учитывать возможности и риски передового уровня, не подрывая конкуренцию, не укрепляя позиции устоявшихся игроков и не стимулируя утечку инноваций за рубеж.

Серьезная общественная структура должна уменьшать, а не увеличивать концентрацию власти. Сегодня передовые лаборатории в основном сами устанавливают правила управления рисками передового уровня. Демократически подотчетные стандарты, независимая верификация и значимая прозрачность должны прийти на смену этой фрагментированной системе частного управления.

Это имеет решающее значение для лидерства Америки. Соединенные Штаты не смогут выиграть эпоху ИИ за счет одних лишь возможностей. Техническое превосходство будет иметь мало значения, если люди, институты и правительства недостаточно доверяют технологии, чтобы внедрять ее. Надежные меры безопасности — это не уступка в ущерб инновациям. Они являются частью инфраструктуры, необходимой для широкого внедрения и прочного лидерства Америки.

Поддержание динамики на уровне штатов

Нам крайне необходимы национальные стандарты в области ИИ, и каждый, кто работает на переднем крае, видит эту срочность. До тех пор пока Конгресс не начнет действовать, штаты должны продолжать заполнять образовавшийся вакуум и повышать планку.

OpenAI поддержала законопроект SB 53 в Калифорнии, закон RAISE в Нью-Йорке, SB 315 в Иллинойсе, а также независимые аудиты в рамках законодательства о безопасности передовых разработок, рассматриваемого в Массачусетсе. Мы призываем штаты объединяться вокруг этих общих мер безопасности. По мере этого они смогут создать де-факто национальную базу, которую Конгресс в конечном итоге сможет закрепить законодательно — подход, который мы называемобратным федерализмом. Но гармонизация не означает замораживание требований на месте.

Сегодня мы официально поддерживаем четыре дополнительных законопроекта Калифорнии, которые прошли легислатуру и направляются на подпись к губернатору Ньюсому. В совокупности они затрагивают взаимодополняющие части экосистемы безопасности ИИ.

SB 813 установит процедуру назначения квалифицированных, независимых организаций, способных оценивать риски ИИ. Как мы заявляли в нашейконцепции федеральной структуры, мы предпочитаем, чтобы независимые технические оценки требовались на федеральном уровне, где политики могут установить единые стандарты квалификации оценщиков, безопасности и доступа к крайне конфиденциальной информации. Однако в отсутствие действий на федеральном уровне Калифорния может помочь установить правила игры для создания безопасной, эффективной национальной системы независимой оценки, которая обеспечит лучшие результаты в сфере безопасности.

AB 1405 создаст требования по регистрации, независимости, прозрачности и подотчетности для аудиторов ИИ.

SB 1119 потребует подтверждения возраста, оценки рисков, независимых аудитов, родительского контроля и мер защиты от вредоносного контента для детей и подростков, использующих чат-ботов-компаньонов. Недавно мы выразили поддержку этому законопроекту, который опирается на меры безопасности для молодежи, продвигаемые OpenAI в наших продуктах, глобальных принципах политики и поддержкуЗакона о безопасности ИИ для родителей и детей (Parents & Kids Safe AI Act), а также функции защиты, встроенные в ChatGPT для подростков, включая более строгие настройки по умолчанию в чувствительных областях, «тихие часы», учебные часы и напоминания о перерывах.

AB 1864 потребует от поставщиков генного синтеза и производителей настольного оборудования для синтеза соблюдения федеральных стандартов скрининга, укрепляя важный физический барьер безопасности против биологических угроз, создаваемых с помощью ИИ.

Некоторые из этих законопроектов мы ранее не поддерживали, а теперь поддерживаем после переосмысления в свете недавнего скачка возможностей, который мы наблюдаем.

Эти законопроекты не заменяют федеральное регулирование. Это серьезные усилия, которые могут защитить людей уже сейчас, продемонстрировать, как выглядят работающие меры безопасности, и помочь создать импульс для федеральных действий.

Призыв к принятию отраслевых стандартов мониторинга передового ИИ

Сам по себе закон не сделает передовой ИИ безопасным. Нам также необходимы конкретные практики внутри лабораторий, разрабатывающих самые мощные системы. Самое срочное место для начала — это мониторинг.

Это особенно важно для проблемы несоответствия целей (misalignment), когда модель преследует цель способами, нарушающими намерения человека или установленные границы, без необходимости наличия сознания или злого умысла. По мере того как модели приобретают большую автономность, используют более мощные инструменты и работают в течение более длительных периодов времени, разработчики должны быть обязаны отслеживать такое несогласованное поведение и демонстрировать наличие эффективных мер безопасности.

Мониторинг должен быть связан с четкими требованиями к раскрытию информации. Как мы выступали в Калифорнии, компании должны быть обязаны направлять оперативное письменное уведомление пострадавшим сторонам, если во время разработки или оценки их модели несанкционированно обходят средства контроля безопасности другой организации и существенно получают доступ, изменяют или уничтожают защищенные системы или конфиденциальную информацию этой организации. Мы также поддерживаем федеральные требования к отчетности о других серьезных инцидентах, связанных с ИИ, и работаем над тем, чтобы определить, какие инциденты должны подлежать охвату и что должны в себя включать эти требования.

Как мы сообщали на прошлой неделе, OpenAI разрабатывает структуру для отчетности о значительных инцидентах несоответствия целей и систематического мониторинга активности передовых моделей, включая внутреннее использование. Это начинается как инициатива самой компании, но мы надеемся, что она поможет сформировать более широкую федеральную политику и требования к отчетности.

Мы хотим работать с другими лабораториями над отраслевыми стандартами. Любые отраслевые стандарты дополнят, но не заменят обязательные федеральные меры безопасности и демократический надзор. Но мы вступили в другую фазу возможностей ИИ, и все должно быть поставлено на карту, включая рассмотрение того, что может быть построено на добровольной основе за пределами правительства в качестве немедленного шага.

Любые подобные стандарты в конечном итоге должны выйти за национальные границы. Модели, исследования и технический опыт перемещаются глобально, и сбои с участием самых мощных систем могут иметь последствия далеко за пределами страны, в которой они были разработаны. Соединенным Штатам необходимо установить заслуживающие доверия стандарты у себя дома, если они собираются лидировать на международном уровне, и мы все больше убеждаемся, что совместимые международные стандарты будут необходимы.

Используйте это окно

Окно возможностей для политики в сфере ИИ открыто, пока еще открыто. Мы намерены им воспользоваться.

Это означает действовать срочно, смиренно и с готовностью адаптироваться. Это означает поддержку серьезных предложений, которые существенно повышают планку безопасности, даже если они не совсем такие, какими бы их спроектировали мы. И это означает укрепление структуры по мере развития технологии.

Ни один первый шаг не будет идеальным. Но больший риск сейчас — ждать слишком долго, чтобы сделать хотя бы один.

Автор

Chris Lehane

Полный текст статьи читайте на OpenAI прочитано 306 раз