Перенос состязательной устойчивости между типами возмущений

Аннотация
Мы изучаем перенос состязательной устойчивости (adversarial robustness) глубоких нейронных сетей между различными типами возмущений. Хотя большинство работ по состязательным примерам сосредоточено на L∞ L_∞ — и L2 L_2 -ограниченных возмущениях, они не охватывают все типы возмущений, доступные злоумышленнику. В настоящей работе оценивается 32 атаки 5 различных типов на моделях, прошедших состязательное обучение на подмножестве ImageNet из 100 классов. Наши эмпирические результаты показывают, что оценка в широком диапазоне размеров возмущений необходима для понимания того, переносится ли состязательная устойчивость между типами возмущений. Мы также демонстрируем, что устойчивость к одному типу возмущений не всегда гарантирует, а иногда может даже ухудшать устойчивость к другим типам возмущений. В свете этих результатов мы рекомендуем проводить оценку состязательной защиты на разнообразных типах и размерах возмущений.
Авторы
Полный текст статьи читайте на OpenAI
