Публикация нашего регламента комплаенса для калифорнийского Закона о прозрачности передовых систем ИИ
1 января в Калифорнии вступает в силу Закон о прозрачности передовых систем ИИ (SB 53). Он устанавливает первые в стране требования безопасности и прозрачности для передового искусственного интеллекта в отношении катастрофических рисков.
Хотя мы долгое время выступали за создание федеральной нормативной базы, Anthropic поддержала законопроект SB 53, поскольку мы убеждены, что разработчики передового ИИ, подобные нам, должны открыто рассказывать о том, как они оценивают эти риски и управляют ими. Что немаловажно, этот закон находит баланс между необходимостью строгих мер безопасности, отчетности об инцидентах и защиты информаторов, сохраняя при этом гибкость в реализации мер безопасности разработчиками и освобождая небольшие компании от избыточного регулирования.
Одно из ключевых требований закона заключается в том, что разработчики передового ИИ обязаны опубликовать регламент, описывающий порядок оценки и предотвращения катастрофических рисков. Наш регламент комплаенса в сфере передовых технологий (Frontier Compliance Framework — FCF) теперь доступен общественности здесь. Ниже мы рассказываем о его содержимом и о том, какими должны быть следующие шаги в направлении прозрачности передового ИИ.
Что входит в наш регламент комплаенса в сфере передовых технологий
Наш FCF описывает, как мы оцениваем и снижаем угрозы кибератак, химического, биологического, радиологического и ядерного характера, а также риски саботажа со стороны ИИ и потери контроля над передовыми моделями. В документе также изложена наша многоуровневая система оценки возможностей моделей на предмет соответствия этим категориям рисков и объяснен наш подход к мерам противодействия. Кроме того, в нем затрагиваются вопросы защиты весов моделей и реагирования на инциденты безопасности.
Многие положения FCF являются эволюцией практик, которым мы следуем уже много лет. Начиная с 2023 года, наша политика ответственного масштабирования (Responsible Scaling Policy — RSP) определяет наш подход к управлению экстремальными рисками от передовых систем ИИ и формирует основу для принятия решений в области разработки и развертывания ИИ. Кроме того, при выпуске новых моделей мы публикуем подробные системные карты (system cards), в которых описываются их возможности, результаты оценок безопасности и анализа рисков. Другие лаборатории также добровольно внедрили аналогичные подходы. Согласно новому закону, вступающему в силу 1 января, такие практики прозрачности становятся обязательными для создателей самых мощных систем ИИ в Калифорнии.
В дальнейшем FCF будет служить нашей базой для соблюдения требований SB 53 и других нормативных актов. При этом RSP останется нашей добровольной политикой безопасности, отражающей наши представления о наилучших практиках по мере развития сферы ИИ — даже в тех случаях, когда они выходят за рамки текущих законодательных требований или отличаются от них.
Необходимость федерального стандарта
Вступление в силу закона SB 53 — важный рубеж. Закрепляя на официальном уровне достижимые стандарты прозрачности, которым ответственные лаборатории уже добровольно следуют, закон гарантирует, что эти обязательства не будут тихо забыты в будущем по мере роста возможностей моделей или усиления конкуренции. Теперь для обеспечения единого подхода на территории всей страны необходима федеральная нормативно-правовая база в области прозрачности ИИ.
Ранее в этом году мы предложили концепцию для федерального законодательства. Она делает акцент на общедоступности информации о мерах безопасности, избегая привязки к конкретным техническим подходам, которые со временем могут утратить актуальность. Основные принципы нашей концепции включают в себя:
- Требование публичного регламента безопасной разработки: Профильные разработчики должны публиковать документ, описывающий методы оценки и минимизации серьезных рисков, включая химические, биологические, радиологические и ядерные угрозы, а также риски, связанные с потерей согласованности (мисалайментом) автономных моделей.
- Публикацию системных карт при развертывании: Документация, обобщающая тестирование, процедуры оценки, результаты и меры по минимизации рисков, должна обнародоваться при развертывании моделей и обновляться в случае их существенной модификации.
- Защиту информаторов (уоблефлоуэров): Нарушением закона должно прямо признаваться утаивание лабораторией информации о соблюдении собственных регламентов или преследование сотрудников, сообщающих о нарушениях.
- Гибкие стандарты прозрачности: Эффективный регламент прозрачности ИИ должен устанавливать минимальный набор стандартов для повышения безопасности общества без ущерба для гибкости развивающейся сферы ИИ. Требования должны быть адаптивными и легковесно меняться по мере формирования общепринятых передовых практик.
- Ограничение сферы применения крупнейшими разработчиками моделей: Во избежание избыточной нагрузки на экосистему стартапов и мелких разработчиков, создающих модели с низким риском причинения катастрофического вреда, требования должны распространяться исключительно на признанных лидеров, создающих самые мощные модели.
По мере того как системы ИИ становятся все более мощными, общественность имеет право знать, как они разрабатываются и какие меры предосторожности принимаются. Мы с нетерпением ждем возможности сотрудничать с Конгрессом и администрацией над созданием национальной нормативно-правовой базы прозрачности, которая гарантирует безопасность и одновременно сохранит лидерство Америки в сфере искусственного интеллекта.
Полный текст статьи читайте на Anthropic
