Представляем Центр прозрачности Anthropic

Сегодня мы запускаем Центр прозрачности Anthropic — подробный обзор конкретных мер, которые мы реализуем для обеспечения безопасности, полезности и надежности наших систем.
Поскольку возможности искусственного интеллекта стремительно развиваются, подлинная прозрачность имеет важнейшее значение для формирования доверия и подотчетности. Организации, работающие над передовым ИИ, несут ответственность за предоставление четкого представления о своих процессах ответственного масштабирования, протоколах безопасности и стратегии минимизации рисков — особенно по мере того, как продолжают развиваться регуляторные базы. В качестве отправной точки мы публикуем наш первый периодический отчет по нескольким ключевым метрикам прозрачности: заблокированные учетные записи, апелляции по учетным записям, отмененные решения по апелляциям, отчеты в Национальный центр по поиску пропавших и эксплуатируемых детей (NCMEC), а также данные о запросах правительств.
Наш Центр прозрачности предлагает подробную информацию о:
- Методологиях оценки моделей и тестирования безопасности
- Мерах по обнаружению злоупотреблений на платформе и принудительном исполнении правил
- Политике внутреннего управления и оценки рисков
- Методах оценки и учета потенциального влияния на общество
- Исследовательских инициативах, продвигающих сферу безопасности ИИ
- Средствах защиты безопасности и конфиденциальности, внедряемых на всех этапах разработки
Больше, чем просто отчетность
Мы разработали наш подход так, чтобы решить ключевую проблему в управлении ИИ: распространение разрозненных требований к документации в рамках множества инициатив по прозрачности и добровольных обязательств. Этот центр представляет собой единую структуру, призванную удовлетворить весь спектр требований. Он позволяет пользователям, политикам и заинтересованным сторонам получить четкое представление о разработке и внедрении наших моделей в структурированном, доступном и подотчетном виде.
Постоянные обязательства
В соответствии с нашим стремлением повышать планку прозрачности, мы будем постоянно расширять нашу отчетность, чтобы отражать передовой опыт по мере развития возможностей ИИ и появления новых задач.
Мы приглашаем вас изучить Центр прозрачности и воочию убедиться, как мы работаем над созданием заслуживающих доверия систем ИИ. Мы будем рады вашим отзывам по адресу transparency@anthropic.com.
Полный текст статьи читайте на Anthropic
