Перенос состязательной устойчивости между типами возмущений

Читать статью
Transfer Of Adversarial Robustness Between Perturbation Types

Аннотация

Мы изучаем перенос состязательной устойчивости (adversarial robustness) глубоких нейронных сетей между различными типами возмущений. Хотя большинство работ по состязательным примерам сосредоточено на L∞ L_∞ — и L2 L_2 -ограниченных возмущениях, они не охватывают все типы возмущений, доступные злоумышленнику. В настоящей работе оценивается 32 атаки 5 различных типов на моделях, прошедших состязательное обучение на подмножестве ImageNet из 100 классов. Наши эмпирические результаты показывают, что оценка в широком диапазоне размеров возмущений необходима для понимания того, переносится ли состязательная устойчивость между типами возмущений. Мы также демонстрируем, что устойчивость к одному типу возмущений не всегда гарантирует, а иногда может даже ухудшать устойчивость к другим типам возмущений. В свете этих результатов мы рекомендуем проводить оценку состязательной защиты на разнообразных типах и размерах возмущений.

Авторы

Daniel Kang, Yi Sun, Tom Brown, Dan Hendrycks, Jacob Steinhardt

Полный текст статьи читайте на OpenAI