다단계 AI 공격, 모델의 88%에서 우회 성공
Multi-turn AI attacks break models 88% of the time

TL;DR AI
1분핵심 요약
Cisco는 15개 대표 AI 모델에 대해 6,986건의 다단계 공격을 테스트했고, 최대 88.3%의 성공률을 확인했다.
이는 단일 턴 레드팀 테스트로는 드러나지 않던 취약점이, 긴 대화형 공격에서 더 쉽게 노출된다는 뜻이다.
조사에 따르면 많은 기업이 이미 에이전트 보안 사고나 아찔한 상황을 겪었지만, 여전히 벤더 기본 보안 기능에 크게 의존하고 있다.
전문가들은 scoped identity와 샌드박스 같은 격리 수단 없이 AI 에이전트를 빠르게 배포하는 것이 큰 위험이라고 경고한다.
