Практики управления автономными системами ИИ

Читать документПодать заявку на грант для исследования автономного ИИ
Practices For Governing Agentic AI Systems

Аннотация

Автономные системы ИИ — системы искусственного интеллекта, способные преследовать сложные цели при ограниченном прямом надзоре, — скорее всего, окажутся крайне полезными, если мы сможем ответственно интегрировать их в наше общество. Хотя такие системы обладают значительным потенциалом для более эффективного и результативного достижения людьми собственных целей, они также создают риски причинения вреда. В этом техническом документе мы предлагаем определение автономных систем ИИ и сторон, участвующих в их жизненном цикле, а также подчеркиваем важность согласования набора базовых обязанностей и передовых практик обеспечения безопасности для каждой из этих сторон. В качестве основного вклада мы предлагаем предварительный набор практик для поддержания безопасности и подотчетности работы агентов, которые, как мы надеемся, смогут послужить строительными блоками при разработке согласованных базовых передовых практик. Мы перечисляем вопросы и неопределенности, связанные с практической реализацией каждой из этих практик, которые необходимо разрешить до того, как они будут кодифицированы. Затем мы выделяем категории косвенных последствий широкомасштабного внедрения автономных систем ИИ, которые, вероятно, потребуют создания дополнительных нормативно-правовых баз.

Программа грантов на исследования в области автономного ИИ

Мы запускаем программу выдачи грантов на сумму от 10 000 до 100 000 долларов США для финансирования исследований влияния автономных систем ИИ и практик обеспечения их безопасности.

Прием заявок на участие в программе грантов завершен.

Ведущие авторы

Йонадав Шавит (Yonadav Shavit), Сандини Агарвал (Sandhini Agarwal), Майлз Брандейдж (Miles Brundage)

Авторы разделов

Стивен Адлер (Steven Adler), Каллен О«Кифи (Cullen O«Keefe), Рози Кэмпбелл (Rosie Campbell), Тедди Ли (Teddy Lee), Памела Мишкин (Pamela Mishkin), Тина Элонду (Tyna Eloundou), Алан Хикки (Alan Hickey), Катарина Слама (Katarina Slama), Лама Ахмад (Lama Ahmad), Пол Макмиллан (Paul McMillan), Андреа Валлоне (Andrea Vallone), Александр Пассос (Alexandre Passos), Дэвид Дж. Робинсон (David G. Robinson)

Полный текст статьи читайте на OpenAI