Помощь в создании общих стандартов для передового ИИ

helping-build-shared-standards-for-advan

Модели с возрастающими возможностями способны усилить киберзащиту, ускорить научные открытия и расширить доступ к экспертным знаниям. Но они также могут создавать риски для безопасности, если их возможности истолковываются неверно, средства защиты недостаточны, а у правительств отсутствует информация, необходимая для реагирования. Чтобы безопасно и уверенно использовать преимущества ИИ, обществу понадобятся институты с техническим и управленческим потенциалом для оценки, защиты и регулирования все более мощных систем.

Это одна из причин, почему OpenAI помогла основать фонд Appia под эгидой Linux Foundation. Appia займется разработкой открытых модульных спецификаций, призванных переводить международные стандарты и устоявшиеся концепции в практические критерии оценки по всей цепочке создания стоимости ИИ. Эта работа поможет сформировать критически важный недостающий уровень доверия, с помощью которого третьи стороны смогут проверять соответствие стандартам, создавая более четкие и пригодные для повторного использования свидетельства в случаях, когда модели, инфраструктура и приложения разрабатываются разными организациями. В рамках этой деятельности Appia поможет создать общий технический язык, который позволит национальным и международным институтам доверять работе друг друга.

Мы рассматриваем эти усилия как важный следующий шаг в рамках более масштабной работы по укреплению институтов, стандартов и методов оценки, необходимых для передовых систем ИИ.

Наша недавняя концепция демократического управления передовым ИИ предлагает дорожную карту для этой работы. В ней содержится призыв к созданию долгосрочной структуры в США, усиленного Центра стандартов и инноваций в сфере ИИ (CAISI), а также более широкой стратегии устойчивости на уровне правительства. В ней также признается, что риски передового ИИ носят международный характер. Странам следует работать совместно над созданием совместимых систем безопасности, надежных каналов обмена информацией о рисках и скоординированных мер реагирования на инциденты.

Национальный потенциал и международное сотрудничество должны подкреплять друг друга. Сильные институты, такие как CAISI, способны развивать техническую экспертизу, оценивать передовые системы и поддерживать экосистему независимой оценки. Сеть дееспособных национальных институтов сможет затем выработать общие методы, признавать надежные свидетельства и обеспечивать правительствам общее техническое понимание, необходимое для совместных действий.

Стандарты играют центральную роль в этих усилиях, и они должны опираться на надежную практику оценки и техническую строгость. В нашем общем руководстве по заслуживающим доверия независимым оценкам мы изложили требования, которые все чаще должны раскрываться при оценке передовых систем: тестируемая система, доступ к ее инструментам и среда тестирования, методы, используемые для выявления возможностей, доступные ресурсы и проверки, выполненные для подтверждения результатов. Мы также претворили эти принципы в жизнь посредством партнерств по тестированию с американским CAISI и британским AISI, чья работа по оценке возможностей передовых моделей и мерам защиты от биологического нецелевого использования привела к конкретным улучшениям в наших системах. Эта работа выполняет важную функцию по созданию основы для практик, которые можно стандартизировать для сопоставимой проверки производительности.

Эти практики дополняют более широкую инфраструктуру безопасности OpenAI. Наша концепция готовности (Preparedness Framework) служит основой для того, как мы определяем и применяем наш подход к управлению самыми серьезными рисками от передовых систем ИИ, включая наши внутренние правила. Наша концепция управления передовым ИИ (Frontier Governance Framework) переносит соответствующие аспекты этого подхода в публичный управленческий документ, посвященный конкретным регуляторным обязательствам, включая оценку рисков, отчетность по моделям, средства контроля безопасности, реагирование на инциденты и привлечение внешних экспертов. В совокупности эти материалы помогают перевести масштабные обязательства в операционные практики, которые можно проверять и совершенствовать.

Работа Appia нацелена на решение следующей задачи: сделать эти практики совместимыми между различными организациями, юрисдикциями и элементами цепочки поставок.

OpenAI уже вносит свой вклад в более широкую экосистему стандартов и инициатив по стандартизации. Мы участвуем в работе Общего технического комитета 1, подкомитета 42 по искусственному интеллекту Международной организации по стандартизации и Международной электротехнической комиссии и возглавляемого Национальным институтом стандартов и технологий Консорциума по искусственному интеллекту; помогали основать Frontier Model Forum и Фонд автономного искусственного интеллекта (Agentic Artificial Intelligence Foundation) при Linux Foundation; участвуем в Коалиции за безопасный искусственный интеллект; входим в руководящий комитет Коалиции за происхождение и подлинность контента;, а также участвуем в процессах Инженерного совета Интернета и альянса FIDO по продвижению совместимых технических стандартов.

Во всех этих направлениях, в том числе теперь и через Appia, наша цель заключается в том, чтобы перенести уроки разработки передовых систем в открытые, технически обоснованные практики, которые правительства, компании и независимые эксперты смогут использовать в различных юрисдикциях.

Автор

OpenAI

Полный текст статьи читайте на OpenAI