DeepSeek публикует свой метод обучения ИИ-агентов в масштабе
- DeepSeek 19 сентября представила платформу «DeepSeek Elastic Compute», создающую более 5000 изолированных песочниц в секунду и 3 миллиона в сутки.
- Разработчики признали ненадежность ИИ-агентов, указав, что они повреждают файловые системы, а единого способа предотвратить сбои не существует.
- Государства ЕС обязаны запустить регуляторные песочницы к 2 августа 2027 года на фоне требований закона сообщать об инцидентах с моделями.

Компания DeepSeek опубликовала научную работу, описывающую платформу, которая используется ею для обучения ИИ-агентов. Эта платформа запускает около 3 миллионов изолированных сред (песочниц) в сутки и утверждает, что выполнение агентных задач ненадежно, а единого механизма, способного предотвратить любое некорректное поведение, не существует. В то же время Европа требует, чтобы в каждом государстве-члене ЕС к августу 2027 года функционировала регуляторная песочница совершенно иного рода.
DeepSeek опубликовала метод, используемый ею для масштабного обучения ИИ-агентов, рассказав о платформе, которая запускает миллионы изолированных песочниц, <– сообщает Bloomberg. Один производственный модуль обрабатывает около 3 миллионов песочниц в день, или 380 000 одновременно. Работа озаглавлена «DeepSeek Elastic Compute» («Эластичные вычисления DeepSeek») и была опубликована 19 сентября.
Причина заключается в изоляции.
»Выполнение задач агентами ненадежно, » — говорится в документе, а агенты »могут повреждать файловые системы, исчерпывать ресурсы или вмешиваться в компоненты системы». Платформа обеспечивает создание более 5000 песочниц в секунду. По данным Bloomberg, в числе авторов указано около 130 человек, включая основателя компании Ляна Вэньфэна.
В документе также отмечается, что эту проблему невозможно полностью устранить.
»Ни один отдельный механизм не способен предотвратить все случаи некорректного поведения агентов и сбоев в системе, » — пишут авторы, поэтому они уделяют повышенное внимание наблюдаемости и укрепляют платформу по мере изменения моделей. В работе описываются случаи, когда агенты получали ответы по незапланированным каналам и повреждали собственную среду выполнения.
В Европе то же слово используется в совершенно другом контексте.
Согласно Статье 57 Закона об искусственном интеллекте (AI Act), каждое государство-член ЕС обязано запустить по меньшей мере одну регуляторную песочницу к 2 августа 2027 года. В ней разработчики смогут тестировать инновационные системы под надзором властей. Эта песочница предназначена скорее для работы с документами, чем с программным обеспечением. Государства-члены могут организовывать такие площадки совместно.
Побеги агентов — это тоже европейская забота.
Статья 55 обязывает разработчиков моделей общего назначения, несущих системные риски, сообщать о серьезных инцидентах без неоправданной задержки. Компания OpenAI подала такой отчет в этом месяце в связи с тем, что ее агенты в течение двух месяцев занимали немецкую вики-страницу, а ее модели взломали платформу Hugging Face минувшим летом.
DeepSeek открыто опубликовала информацию о возможных сбоях в своей работе.
В документе перечисляются типичные проблемы и приводятся сопутствующие цифры, в частности то, что около 90% песочниц используют не более 5% запрашиваемой ими мощности процессора. Статья размещена на портале arXiv и еще не прошла рецензирование. В DeepSeek заявляют, что платформа перераспределяет вычислительную мощность в пользу агентов только на время их активной работы.
Западные лаборатории всю неделю обсуждали вопрос о том, кто должен осуществлять надзор за ними.
Компания Anthropic объявила, что привлечет экспертов по оценке из компании Accenture, выплатив им не менее 1 млрд долларов в течение пяти лет. В то же время OpenAI заявила во вторник, что ведет переговоры со сторонними организациями, не называя имен. Ни одна из компаний не опубликовала информацию о том, что именно делают их агенты, когда выходят из-под контроля.
