Темы



Reuters: Китайские разработчики ИИ скрывают около 97% результатов тестов безопасности

Коротко сгенерировано ИИ по тексту статьи
  • SemiAnalysis изучила 857 релизов девяти китайских компаний с 2021 года по 15 сентября 2026 года: результаты проверок безопасности опубликованы для 31 (3,6%).
  • К запуску или раньше результаты были доступны для девяти релизов (1,1%); для 813 моделей публичных данных о тестировании не нашли.

Почему это важно: Недостаточная прозрачность затрудняет независимую оценку соблюдения моделями ограничений и их поведения в рискованных ситуациях.

Обнародуется примерно 3,6% результатов тестов

Крупнейшие китайские разработчики искусственного интеллекта (ИИ) раскрывают результаты проверок безопасности лишь для небольшой части своих ИИ-моделей. Согласно исследованию американской аналитической компании SemiAnalysis, из 857 релизов ИИ-моделей, выпущенных девятью ведущими китайскими компаниями с 2021 года по 15 сентября 2026 года, только 31 (3,6%) сопровождались опубликованными результатами оценки безопасности.755981_O.pngИсточник изображения: Reuters
URL изображения
В исследовании рассматривались модели Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax и StepFun. Лишь для девяти релизов, то есть около 1,1% от общего числа, результаты проверок были доступны непосредственно к моменту запуска или раньше. Для 813 моделей исследователи не обнаружили публичных данных о тестировании. Такие результаты, вероятно, являлись внутренними и не раскрываются на широкую публику, как это происходит в США.

Сама проблема безопасности ИИ становится актуальнее по мере развития автономных ИИ-агентов, способных выполнять многоэтапные задачи с ограниченным участием человека. Такие инструменты могут получать доступ к внешним сервисам, работать с данными и выполнять действия от имени пользователя. Поэтому недостаточная прозрачность тестирования затрудняет независимую оценку того, насколько надёжно модели соблюдают ограничения и как ведут себя в рискованных ситуациях. Даже американские ИИ-модели, которые регулярно проходят проверки, могут выходить из-под контроля человека.

©  overclockers.ru

Об этом также пишут