SafetyKit масштабирует агентов по управлению рисками с помощью передовых моделей OpenAI

От создания прототипов на базе ранних версий визуальных моделей до масштабирования с помощью GPT‑5: мультимодальные агенты SafetyKit осваивают новые сферы и повышают точность работы.

Связаться с отделом продаж
SafetyKit logo in white centered on a dark, vertically textured background with a warm gradient of orange, yellow, and teal light.
Масштаб компании: Стартап
Регион: Северная Америка
Отрасль: Технологии, услуги
Продукты: API

Результаты

95%+

Точность при проверке 100% клиентского контента (согласно оценкам SafetyKit)

Результаты

16 млрд

Токенов обрабатывается ежедневно по сравнению с 200 млн полгода назад

Результаты

10+ п.п.

Прирост производительности на самых сложных визуальных задачах с использованием GPT-5

SafetyKit создает мультимодальные ИИ-агенты, которые помогают торговым площадкам, платежным платформам и финтех-компаниям выявлять мошенничество и запрещенную активность в текстах, изображениях, финансовых транзакциях, объявлениях и других типах контента, а также принимать соответствующие меры. Недавние прорывы в области логического вывода моделей и мультимодального понимания сделали эти инструменты еще более эффективными, установив новый стандарт для операций по обеспечению безопасности, комплаенса и управления рисками.

Агенты SafetyKit используют GPT‑5, GPT‑4.1, функции глубокого исследования (deep research) и инструмент компьютерного управления (Computer Using Agent, CUA) для проверки 100% клиентского контента с точностью более 95% (согласно собственным оценкам компании). Они помогают платформам защищать пользователей, предотвращать мошенничество, избегать регуляторных штрафов и соблюдать сложные правила, которые устаревшие системы могут пропускать, например, региональные требования, скрытые номера телефонов на изображениях мошенников или нежелательный контент. Автоматизация также ограждает человеческих модераторов от контакта с вредоносными материалами и освобождает их время для принятия сложных экспертных решений по соблюдению политик.

«OpenAI дает нам доступ к самым передовым моделям рассуждений и мультимодальным моделям на рынке. Это позволяет нам быстро адаптироваться, быстрее выпускать новых агентов и обрабатывать типы контента, которые другие решения даже не могут разобрать».
Дэвид Граунке (David Graunke), основатель и генеральный директор SafetyKit

Создавайте агентов под требования задачи, а затем выбирайте подходящую модель

Каждый агент SafetyKit создан для работы с определенной категорией рисков — от мошенничества до нелегальных товаров. Любой контент направляется агенту, который лучше всего подходит для выявления конкретного нарушения, с использованием оптимальной модели OpenAI:

  • GPT‑5 применяет мультимодальные рассуждения к текстам, изображениям и интерфейсам для выявления скрытых рисков и поддержки многоуровневого принятия точных решений
  • GPT‑4.1 надежно следует подробным инструкциям политики в отношении контента и эффективно управляет рабочими процессами модерации больших объемов
  • Тонкая настройка на основе подкрепленного обучения (RFT) повышает полноту и точность по сравнению с базовыми моделями, обеспечивая передовую производительность при работе со сложными правилами безопасности
  • Глубокое исследование (deep research) интегрирует онлайн-расследования в реальном времени в процессы проверки продавцов
  • Агент компьютерного управления (CUA) автоматизирует сложные задачи по соблюдению политик, снижая зависимость от дорогостоящей ручной проверки

Такой подход к подбору моделей позволяет SafetyKit масштабировать проверку контента по всем модальностям с большей точностью и вниманием к нюансам, чем это возможно с помощью устаревших решений.

Например, агент обнаружения мошенничества выходит за рамки простого сканирования текста. Он анализирует визуальные элементы, такие как QR-коды или номера телефонов, внедренные в изображения товаров. GPT‑4.1 помогает разбирать изображение, понимать его структуру и определять, является ли оно нарушением правил.

Агент проверки соблюдения правил (Policy Disclosure) проверяет объявления или целевые страницы на наличие обязательных формулировок, таких как юридические дисклеймеры или региональные предупреждения о соответствии. GPT‑4.1 извлекает соответствующие разделы, GPT‑5 оценивает соответствие требованиям, а агент сообщает о нарушениях.

«Мы рассматриваем наших агентов как специализированные рабочие процессы, — отмечает Граунке. — Для одних задач требуется глубокое рассуждение, для других — мультимодальный контекст. OpenAI — единственный стек, обеспечивающий надежную работу в обоих случаях».

Line and bar chart labeled

Используйте GPT‑5 для работы в «серых зонах» и принятия ответственных решений

Решения в рамках политик часто зависят от тонких различий. Возьмем, к примеру, торговую площадку, требующую от продавцов добавлять дисклеймер к товарам для здоровья, причем требования различаются в зависимости от заявлений о свойствах продукта и региональных правил. Устаревшие провайдеры используют триггеры по ключевым словам или жесткие наборы правил, которые могут не учитывать более глубокие экспертные оценки, требуемые в таких ситуациях, что ведет к пропускам или ошибочному применению мер.

Агент соблюдения правил SafetyKit сначала обращается к политикам из внутренней библиотеки компании, после чего GPT‑5 оценивает контент: упоминается ли в нем лечение или профилактика? Продается ли товар в регионе, где дисклеймер является обязательным? И если да, действительно ли в объявлении присутствует необходимая формулировка? Если что-то не соответствует требованиям, GPT‑5 возвращает структурированный результат, который агент использует для выявления проблемы.

«Сила GPT‑5 заключается в том, насколько точно модель способна рассуждать, опираясь на реальные политики, — отмечает Граунке. — Это позволяет нам принимать точные, обоснованные решения даже в нестандартных ситуациях, где другие системы терпят неудачу».

Превращайте каждый выпуск модели в победу продукта

SafetyKit тестирует каждую новую модель OpenAI на самых сложных кейсах, часто внедряя лучшие разработки в тот же день. Тщательные внутренние оценки позволяют команде быстро определять, как новые модели могут улучшить производительность, и бесшовно интегрировать их в свою основную инфраструктуру.

Когда вышла модель OpenAI o3, компания SafetyKit задействовала ее для повышения эффективности работы с пограничными случаями в ключевых областях политик. За ней последовала GPT‑5, и всего через несколько дней она была развернута среди самых требовательных агентов, повысив результаты бенчмарков более чем на 10 пунктов в сложнейших визуальных задачах.

«OpenAI развивается быстро, и мы спроектировали нашу систему так, чтобы не отставать. Каждый новый релиз дает нам операционное преимущество — открывая новые возможности и сферы, которые мы не могли поддерживать раньше, а также повышая полноту охвата и точность, которые мы предоставляем клиентам».
— Дэвид Граунке, основатель и генеральный директор SafetyKit

SafetyKit также возвращает результаты улучшений в экосистему, передавая данные оценок, примеры сбоев в пограничных случаях и аналитические материалы по конкретным политикам напрямую в OpenAI, чтобы помочь в формировании будущей производительности моделей для критически важных нагрузок безопасности.

Масштабируйте клиентскую базу и объемы с помощью лучшего стека OpenAI

Архитектура SafetyKit обеспечивает соблюдение правил в масштабируемом режиме, гарантируя скорость, точность и комплексный охват рисков. За кулисами система теперь обрабатывает более 16 миллиардов токенов ежедневно по сравнению с 200 миллионами полгода назад, анализируя больший объем контента без ущерба для точности.

За это же время компания SafetyKit расширила сферу деятельности на сферу платежных рисков, борьбу с мошенничеством, защиту от эксплуатации детей, борьбу с отмыванием денег, а также привлекла новых клиентов с сотнями миллионов конечных пользователей под защитой SafetyKit. Этот фундамент позволяет клиентам быстро и уверенно реагировать на возникающие риски.

«Мы создали цикл, в котором каждый релиз OpenAI напрямую усиливает наши возможности, — говорит Граунке. — Именно поэтому система постоянно совершенствуется, всегда опережая развивающиеся риски».

Результаты в цифрах

  • Точность более 95% при проверке 100% клиентского контента
  • 16 млрд токенов обрабатывается ежедневно (рост с 200 млн за полгода)
  • Прирост производительности в бенчмарках на 10+ пунктов на самых сложных визуальных задачах

Присоединяйтесь к новой эре работы

Более 1 миллиона компаний по всему миру достигают значимых результатов с помощью OpenAI.
Связаться с отделом продаж

Полный текст статьи читайте на OpenAI