Развитие независимых исследований в области согласования ИИ

SEO_Card__1_.png?w=1600&h=900&fit=fill

Мы выделяем 7,5 млн долларов проекту The Alignment Project для финансирования независимых исследований, направленных на разработку мер по снижению рисков безопасности со стороны несогласованного ИИ.

По мере того как системы искусственного интеллекта становятся все более способными и автономными, исследования в области их согласования должны как идти в ногу со временем, так и масштабировать разнообразие подходов. В OpenAI мы вкладываем значительные средства в передовые исследования по согласованию и безопасности, поскольку это критически важно для нашей миссии. Мы также убеждены, что обеспечение безопасности общего искусственного интеллекта (AGI) и его пользы для каждого не может быть достигнуто какой-то одной организацией, и стремимся поддерживать независимые исследования и концептуальные подходы, которые могут развиваться за пределами передовых лабораторий.

Сегодня мы объявляем о выделении гранта в размере 7,5 млн долларов США проекту The Alignment Project — глобальному фонду независимых исследований в области согласования, созданному Британским институтом безопасности ИИ (UK AISI). Административную поддержку гранта осуществляет организация Renaissance Philanthropy. Этот вклад делает The Alignment Project одним из крупнейших специализированных фондов финансирования независимых исследований по согласованию на сегодняшний день и укрепляет более широкую независимую экосистему.

Передовые лаборатории, такие как OpenAI, занимают уникальное положение, позволяющее им проводить исследования по согласованию, требующие доступа к передовым моделям и значительных вычислительных мощностей — работу, которую независимым исследователям зачастую сложно изучать самостоятельно. Мы направляем значительную часть наших внутренних усилий по согласованию на разработку масштабируемых методов, чтобы прогресс в области согласования не отставал от роста возможностей. Мы верим, что итеративное развертывание — постепенное наращивание возможностей при одновременном усилении мер безопасности — помогает выявлять проблемы на ранних этапах и дает нам конкретные доказательства того, что работает на практике, а ответственная разработка требует масштабной работы по согласованию и безопасности, тесно интегрированной с созданием и внедрением моделей.

Параллельно с этим сфера выигрывает от устойчивых инвестиций в независимые поисковые исследования, которые могут расширить пространство идей и открыть новые направления. Независимые исследования остаются жизненно важными: во многих типах полезных изысканий лаборатории не обладают монопольным преимуществом. Здоровая экосистема согласования зависит от независимых команд, тестирующих различные предположения, разрабатывающих альтернативные концептуальные рамки и изучающих фундаментальные, теоретические и перспективные идеи, которые могут не укладываться в дорожную карту какой-то одной организации.

Поскольку прогресс на пути к AGI в конечном итоге может зависеть от фундаментальных прорывов, которые изменят саму суть проблемы согласования и определят наиболее полезные подходы, важно поддерживать исследования, которые будут иметь значение, даже если сегодняшние доминирующие методы не масштабируются так, как мы ожидаем. В таком сценарии особенно важным становится наличие сильной внешней экосистемы, занимающейся фундаментальной, концептуальной и независимой работой. Проблема согласования и безопасности ИИ обладает беспрецедентной важностью, и нам нужны усилия всех участников, поскольку мы еще не знаем, какие подходы окажутся наиболее долговечными по мере дальнейшего роста возможностей.

Наш грант — приблизительно 5,6 млн фунтов стерлингов по текущему обменному курсу — послужит софинансированием проекта The Alignment Project наряду с другими государственными, филантропическими и отраслевыми спонсорами. Общий объем фонда превышает 27 млн фунтов стерлингов и предназначен для поддержки широкого портфеля исследовательских проектов по согласованию по всему миру, охватывающих такие разнообразные темы, как теория вычислительной сложности, экономическая теория и теория игр, когнитивные науки, а также теория информации и криптография. Отдельным проектам обычно выделяется финансирование в размере от 50 000 до 1 млн фунтов стерлингов, они также могут получить опциональный доступ к вычислительным ресурсам и экспертной поддержке.

Наше финансирование не создает новую программу или процесс отбора и не влияет на уже существующий процесс; оно увеличивает количество прошедших предварительную проверку высококачественных проектов, которые могут получить финансирование в текущем раунде.

UK AISI имеет все возможности для распределения средств на исследования по согласованию в таком масштабе и диапазоне. Институт располагает устоявшейся межотраслевой коалицией, охватывающей правительство, научные круги, благотворительные организации и индустрию, а также действующим механизмом выдачи грантов и большой базой заявок, прошедших экспертную оценку. Будучи исследовательской организацией британского правительства в составе Министерства по делам науки, инноваций и технологий (DSIT), он также имеет мандат, сосредоточенный на серьезных рисках, связанных с ИИ, и обладает опытом реализации программ финансирования исследований.

Поскольку будущее искусственного интеллекта не развернется точно так, как кто-либо предсказывает, и может развиваться очень быстро, мы считаем демократизацию, «устойчивость к рискам ИИ» и итеративное развертывание ключевыми факторами. Хотя мы продолжаем развивать наши передовые исследования в области согласования и безопасности в OpenAI, прогресс выиграет от создания надежной, разнообразной и независимой экосистемы, реализующей взаимодополняющие подходы по мере роста возможностей. Этот грант — один из шагов на пути к данной цели. Мы с нетерпением ждем возможности продолжить сотрудничество с широким исследовательским сообществом по мере развития этой сферы.

Полный текст статьи читайте на OpenAI