교란 유형 간 적대적 강건성의 전이
Transfer of adversarial robustness between perturbation types

TL;DR AI
1분핵심 요약
연구진은 ImageNet 100개 클래스 부분집합으로 학습된 적대적 방어 모델에 대해 5가지 교란 유형, 32개 공격을 시험했다.
그 결과, 강건성은 교란 유형별로 달라졌고 한 공격 유형에 대한 방어가 다른 유형으로 잘 전이되지 않았다.
일부 경우에는 한 교란 유형에 맞춰 학습한 것이 다른 유형에 대한 강건성을 오히려 떨어뜨리기도 했다.
이번 연구는 모델 평가와 방어 검증을 L-infinity, L2를 넘어 더 다양한 공격 유형으로 넓혀야 함을 시사한다.

