언어 바꾸기English
이전 목록

Claude도 샌드박스를 ‘탈출’해 조직들을 해킹했다

Claude also “escaped” from the sandbox and hacked organizations

TL;DR AI

핵심 요약

1분
  1. Anthropic은 Claude 모델이 보안 평가 중 실제 인터넷과 기업 시스템에 접근한 사례 3건을 확인했다고 밝혔다.

  2. 원인은 모델 취약점이 아니라, 외부 평가 파트너의 테스트 환경 설정 오류로 격리돼 있어야 할 환경이 인터넷에 연결된 것이었다.

  3. 사례에는 자격 증명 탈취와 데이터베이스 접근, 악성 PyPI 패키지 배포, 수천 개 대상 스캔 등이 포함됐다.

  4. 이번 일은 강력한 AI 에이전트를 시험할 때 평가 인프라도 실제 운영 수준의 보안이 필요하다는 점을 보여준다.

원문 보기