Мнения об Исполнительном указании США, Кодексе поведения G7 и саммите в Блетчли-Парке

За последнюю неделю в области политики в сфере ИИ произошло три важнейших события: правительство США выпустило масштабный Исполнительный указ об искусственном интеллекте, страны G7 приняли Международный кодекс поведения, а правительство Великобритании провело первый в своем роде саммит по безопасности ИИ в Блетчли-Парке, по итогам которого была опубликована Блетчлиская декларация. В этой публикации мы кратко подводим итоги каждого из этих событий и рассуждаем о том, что они означают для будущей политики в отношении ИИ.
Исполнительный указ США
Этот комплексный исполнительный указ объемом более 100 страниц охватывает весь спектр рисков, связанных с ИИ, включая проблемы конфиденциальности, справедливости и предвзятости, а также катастрофические риски. В нем признается огромный потенциал ИИ и содержатся указания правительственным ведомствам выявлять возможности использования этой технологии для улучшения государственных услуг и функций путем назначения директоров по искусственному интеллекту (Chief AI Officers) и стимулирования инноваций в сфере ИИ в своих структурах.
В соответствии с нашими предыдущими призывами, мы рады видеть, что указ направляет значительные новые усилия на работу с Национальным институтом стандартов и технологий (NIST). Сюда относится разработка оценок возможностей моделей и характеристик безопасности, расширение Структуры разработки безопасного программного обеспечения с целью внедрения практик безопасной разработки для передовых моделей, а также развитие успешной Структуры управления рисками путем создания дополнения для генеративного ИИ.
Кроме того, указ запускает пилотный проект Национального ресурса исследований в области ИИ (NAIRR). Его цель — расширить доступ академических исследователей к данным и вычислительным мощностям, необходимым для проведения исследований по безопасности ИИ и разработки полезных применений технологии, одновременно поддерживая инновации в США. Компания Anthropic неизменно поддерживала NAIRR с момента своего основания (а также связанный с ним Закон CREATE AI) и с нетерпением ждет возможности внести свой вклад в поддержку пилотного проекта NAIRR.
Международный кодекс поведения G7
Разработанный в рамках Хиросимского процесса G7, Кодекс поведения для организаций, разрабатывающих передовые системы ИИ, опирается на добровольные обязательства компаний в сфере ИИ, объявленные Белым домом. В нем описан набор ответственных практик по выявлению и минимизации рисков на протяжении всего жизненного цикла разработки и развертывания ИИ, включая оценки, обмен информацией, подходы к управлению, процедуры безопасности и меры прозрачности. Кодекс устанавливает важные базовые стандарты для компаний, занимающихся передовыми разработками в области ИИ, и при условии широкой поддержки со стороны правительств и бизнеса может послужить основой для лучших мировых практик и национального регулирования. Anthropic поддерживает Кодекс поведения G7, который наряду с обязательствами Белого дома ляжет в основу нашей практики разработки и развертывания технологий.
Саммит по безопасности ИИ
Правительство Великобритании провело исторический саммит по безопасности ИИ в Блетчли-Парке, собравший правительственных чиновников и экспертов из академических кругов, промышленности и гражданского общества для обсуждения проблем передового ИИ и мер по их решению. Генеральный директор Anthropic Дарио Амодей выступил с заявлением о Политике ответственного масштабирования Anthropic, которая, как мы надеемся, сможет послужить ориентиром для других разработчиков передового ИИ и прототипом для потенциальных подходов к регулированию (хотя, что крайне важно, не заменой самому регулированию).
Представители 28 стран подписали Блетчлискую декларацию — масштабное заявление, призывающее к многосторонним действиям по использованию преимуществ технологии и минимизации ее рисков. Примечательно, что среди подписавших документ стран есть Китай и развивающиеся государства. Страны также договорились поддержать международную оценку существующих исследований возможностей и рисков передового ИИ, чтобы информировать правительства о текущем состоянии науки и определять приоритетные направления исследований в области безопасности ИИ. Мы приветствуем Декларацию и создание научной экспертной группы, надеясь, что они послужат стимулом для конкретного и устойчивого международного сотрудничества.
Правительственные институты безопасности ИИ
Также на саммите Великобритания объявила, что ее Целевая группа по передовому ИИ будет реорганизована в Институт безопасности ИИ (AI Safety Institute) — первую крупную правительственную инициативу, сфокусированную на оценке рисков передовых моделей ИИ. В штате Института безопасности ИИ состоят технические эксперты, которые уже занимаются закрытым тестированием передовых моделей ИИ от различных лабораторий, включая Anthropic. Это самое технически изощренное взаимодействие с правительством, в котором Anthropic когда-либо участвовала, и мы надеемся, что подобных инициатив станет больше.
Параллельно с этим Соединенные Штаты объявили о планах запустить американский аналог британского Института безопасности ИИ через консорциум NIST, поддерживающий разработку методов оценки систем ИИ с акцентом на безопасность и надежность. NIST также разработает руководства по краснокомандному тестированию передовых угроз (frontier threats red teaming) для выявления потенциально опасных возможностей моделей двойного назначения. (Хотя мы отметим, что, учитывая важность этого вопроса, поиск путей увеличения финансирования NIST стал бы отличным способом еще больше расширить его возможности в данной сфере).
Ранее мы уже описывали сложности оценки систем ИИ. Правительствам в целом следует инвестировать в собственные возможности по измерению и мониторингу ИИ, и нас воодушевляют усилия США, Великобритании и Сингапура, а также инициативы в Европе. Эффективные методы оценки технологий являются фундаментальным условием для разумного регулирования. Мы также убеждены, что развитие науки об оценке и создание надежных, независимых протоколов тестирования помогут выровнять условия игры в сфере ИИ, позволив менее обеспеченным ресурсами компаниям конкурировать с крупными игроками по тем же критериям безопасности, одновременно предоставляя объективную информацию правительствам, клиентам и широкой общественности.
Заключение
Объявления этой недели знаменуют собой начало нового этапа в области обеспечения безопасности ИИ и формирования регуляторной политики. Крупнейшие мировые державы демонстрируют беспрецедентный интерес и вовлеченность в оценку и мониторинг систем ИИ, и совершенно очевидно, что значительная часть их усилий опирается на способность тестировать и оценивать ИИ-системы на предмет их возможностей, потенциала ненадлежащего использования и присущих свойств безопасности. Мы полны решимости внести свой вклад в достижение этих целей и выступаем за добросовестную гонку стандартов безопасности на опережение.
Полный текст статьи читайте на Anthropic
