SafetyKit масштабирует агентов по управлению рисками с помощью передовых моделей OpenAI
От создания прототипов на базе ранних версий визуальных моделей до масштабирования с помощью GPT‑5: мультимодальные агенты SafetyKit осваивают новые сферы и повышают точность работы.

Результаты
95%+
Точность при проверке 100% клиентского контента (согласно оценкам SafetyKit)
Результаты
16 млрд
Токенов обрабатывается ежедневно по сравнению с 200 млн полгода назад
Результаты
10+ п.п.
Прирост производительности на самых сложных визуальных задачах с использованием GPT-5
SafetyKit создает мультимодальные ИИ-агенты, которые помогают торговым площадкам, платежным платформам и финтех-компаниям выявлять мошенничество и запрещенную активность в текстах, изображениях, финансовых транзакциях, объявлениях и других типах контента, а также принимать соответствующие меры. Недавние прорывы в области логического вывода моделей и мультимодального понимания сделали эти инструменты еще более эффективными, установив новый стандарт для операций по обеспечению безопасности, комплаенса и управления рисками.
Агенты SafetyKit используют GPT‑5, GPT‑4.1, функции глубокого исследования (deep research) и инструмент компьютерного управления (Computer Using Agent, CUA) для проверки 100% клиентского контента с точностью более 95% (согласно собственным оценкам компании). Они помогают платформам защищать пользователей, предотвращать мошенничество, избегать регуляторных штрафов и соблюдать сложные правила, которые устаревшие системы могут пропускать, например, региональные требования, скрытые номера телефонов на изображениях мошенников или нежелательный контент. Автоматизация также ограждает человеческих модераторов от контакта с вредоносными материалами и освобождает их время для принятия сложных экспертных решений по соблюдению политик.
«OpenAI дает нам доступ к самым передовым моделям рассуждений и мультимодальным моделям на рынке. Это позволяет нам быстро адаптироваться, быстрее выпускать новых агентов и обрабатывать типы контента, которые другие решения даже не могут разобрать».
Создавайте агентов под требования задачи, а затем выбирайте подходящую модель
Каждый агент SafetyKit создан для работы с определенной категорией рисков — от мошенничества до нелегальных товаров. Любой контент направляется агенту, который лучше всего подходит для выявления конкретного нарушения, с использованием оптимальной модели OpenAI:
- GPT‑5 применяет мультимодальные рассуждения к текстам, изображениям и интерфейсам для выявления скрытых рисков и поддержки многоуровневого принятия точных решений
- GPT‑4.1 надежно следует подробным инструкциям политики в отношении контента и эффективно управляет рабочими процессами модерации больших объемов
- Тонкая настройка на основе подкрепленного обучения (RFT) повышает полноту и точность по сравнению с базовыми моделями, обеспечивая передовую производительность при работе со сложными правилами безопасности
- Глубокое исследование (deep research) интегрирует онлайн-расследования в реальном времени в процессы проверки продавцов
- Агент компьютерного управления (CUA) автоматизирует сложные задачи по соблюдению политик, снижая зависимость от дорогостоящей ручной проверки
Такой подход к подбору моделей позволяет SafetyKit масштабировать проверку контента по всем модальностям с большей точностью и вниманием к нюансам, чем это возможно с помощью устаревших решений.
Например, агент обнаружения мошенничества выходит за рамки простого сканирования текста. Он анализирует визуальные элементы, такие как QR-коды или номера телефонов, внедренные в изображения товаров. GPT‑4.1 помогает разбирать изображение, понимать его структуру и определять, является ли оно нарушением правил.
Агент проверки соблюдения правил (Policy Disclosure) проверяет объявления или целевые страницы на наличие обязательных формулировок, таких как юридические дисклеймеры или региональные предупреждения о соответствии. GPT‑4.1 извлекает соответствующие разделы, GPT‑5 оценивает соответствие требованиям, а агент сообщает о нарушениях.
«Мы рассматриваем наших агентов как специализированные рабочие процессы, — отмечает Граунке. — Для одних задач требуется глубокое рассуждение, для других — мультимодальный контекст. OpenAI — единственный стек, обеспечивающий надежную работу в обоих случаях».
Используйте GPT‑5 для работы в «серых зонах» и принятия ответственных решений
Решения в рамках политик часто зависят от тонких различий. Возьмем, к примеру, торговую площадку, требующую от продавцов добавлять дисклеймер к товарам для здоровья, причем требования различаются в зависимости от заявлений о свойствах продукта и региональных правил. Устаревшие провайдеры используют триггеры по ключевым словам или жесткие наборы правил, которые могут не учитывать более глубокие экспертные оценки, требуемые в таких ситуациях, что ведет к пропускам или ошибочному применению мер.
Агент соблюдения правил SafetyKit сначала обращается к политикам из внутренней библиотеки компании, после чего GPT‑5 оценивает контент: упоминается ли в нем лечение или профилактика? Продается ли товар в регионе, где дисклеймер является обязательным? И если да, действительно ли в объявлении присутствует необходимая формулировка? Если что-то не соответствует требованиям, GPT‑5 возвращает структурированный результат, который агент использует для выявления проблемы.
«Сила GPT‑5 заключается в том, насколько точно модель способна рассуждать, опираясь на реальные политики, — отмечает Граунке. — Это позволяет нам принимать точные, обоснованные решения даже в нестандартных ситуациях, где другие системы терпят неудачу».
Превращайте каждый выпуск модели в победу продукта
SafetyKit тестирует каждую новую модель OpenAI на самых сложных кейсах, часто внедряя лучшие разработки в тот же день. Тщательные внутренние оценки позволяют команде быстро определять, как новые модели могут улучшить производительность, и бесшовно интегрировать их в свою основную инфраструктуру.
Когда вышла модель OpenAI o3, компания SafetyKit задействовала ее для повышения эффективности работы с пограничными случаями в ключевых областях политик. За ней последовала GPT‑5, и всего через несколько дней она была развернута среди самых требовательных агентов, повысив результаты бенчмарков более чем на 10 пунктов в сложнейших визуальных задачах.
«OpenAI развивается быстро, и мы спроектировали нашу систему так, чтобы не отставать. Каждый новый релиз дает нам операционное преимущество — открывая новые возможности и сферы, которые мы не могли поддерживать раньше, а также повышая полноту охвата и точность, которые мы предоставляем клиентам».
SafetyKit также возвращает результаты улучшений в экосистему, передавая данные оценок, примеры сбоев в пограничных случаях и аналитические материалы по конкретным политикам напрямую в OpenAI, чтобы помочь в формировании будущей производительности моделей для критически важных нагрузок безопасности.
Масштабируйте клиентскую базу и объемы с помощью лучшего стека OpenAI
Архитектура SafetyKit обеспечивает соблюдение правил в масштабируемом режиме, гарантируя скорость, точность и комплексный охват рисков. За кулисами система теперь обрабатывает более 16 миллиардов токенов ежедневно по сравнению с 200 миллионами полгода назад, анализируя больший объем контента без ущерба для точности.
За это же время компания SafetyKit расширила сферу деятельности на сферу платежных рисков, борьбу с мошенничеством, защиту от эксплуатации детей, борьбу с отмыванием денег, а также привлекла новых клиентов с сотнями миллионов конечных пользователей под защитой SafetyKit. Этот фундамент позволяет клиентам быстро и уверенно реагировать на возникающие риски.
«Мы создали цикл, в котором каждый релиз OpenAI напрямую усиливает наши возможности, — говорит Граунке. — Именно поэтому система постоянно совершенствуется, всегда опережая развивающиеся риски».
Результаты в цифрах
- Точность более 95% при проверке 100% клиентского контента
- 16 млрд токенов обрабатывается ежедневно (рост с 200 млн за полгода)
- Прирост производительности в бенчмарках на 10+ пунктов на самых сложных визуальных задачах
Присоединяйтесь к новой эре работы
Полный текст статьи читайте на OpenAI
