Представляем Центр прозрачности Anthropic

Introducing Anthropic's Transparency Hub

Сегодня мы запускаем Центр прозрачности Anthropic — подробный обзор конкретных мер, которые мы реализуем для обеспечения безопасности, полезности и надежности наших систем.

Поскольку возможности искусственного интеллекта стремительно развиваются, подлинная прозрачность имеет важнейшее значение для формирования доверия и подотчетности. Организации, работающие над передовым ИИ, несут ответственность за предоставление четкого представления о своих процессах ответственного масштабирования, протоколах безопасности и стратегии минимизации рисков — особенно по мере того, как продолжают развиваться регуляторные базы. В качестве отправной точки мы публикуем наш первый периодический отчет по нескольким ключевым метрикам прозрачности: заблокированные учетные записи, апелляции по учетным записям, отмененные решения по апелляциям, отчеты в Национальный центр по поиску пропавших и эксплуатируемых детей (NCMEC), а также данные о запросах правительств.

Наш Центр прозрачности предлагает подробную информацию о:

  • Методологиях оценки моделей и тестирования безопасности
  • Мерах по обнаружению злоупотреблений на платформе и принудительном исполнении правил
  • Политике внутреннего управления и оценки рисков
  • Методах оценки и учета потенциального влияния на общество
  • Исследовательских инициативах, продвигающих сферу безопасности ИИ
  • Средствах защиты безопасности и конфиденциальности, внедряемых на всех этапах разработки

Больше, чем просто отчетность

Мы разработали наш подход так, чтобы решить ключевую проблему в управлении ИИ: распространение разрозненных требований к документации в рамках множества инициатив по прозрачности и добровольных обязательств. Этот центр представляет собой единую структуру, призванную удовлетворить весь спектр требований. Он позволяет пользователям, политикам и заинтересованным сторонам получить четкое представление о разработке и внедрении наших моделей в структурированном, доступном и подотчетном виде.

Постоянные обязательства

В соответствии с нашим стремлением повышать планку прозрачности, мы будем постоянно расширять нашу отчетность, чтобы отражать передовой опыт по мере развития возможностей ИИ и появления новых задач.

Мы приглашаем вас изучить Центр прозрачности и воочию убедиться, как мы работаем над созданием заслуживающих доверия систем ИИ. Мы будем рады вашим отзывам по адресу transparency@anthropic.com.

Полный текст статьи читайте на Anthropic