Anthropic이 공개한 같은 사이버보안 취약점을 소형 오픈 모델들이 찾아내며 Claude Mythos 신화가 무너진다
The myth of Claude Mythos crumbles as small open models hunt the same cybersecurity bugs Anthropic showcased

TL;DR AI
2분핵심 요약
Anthropic는 Claude Mythos가 공격적 보안 능력 때문에 엄격하게 제한돼 있다고 밝혔고, 내부 테스트에서는 통제된 환경에서 버그를 찾고 익스플로잇을 구성할 수 있음이 확인됐다.
하지만 AISLE과 Vidoc Security의 별도 테스트에서는 더 작은 모델과 오픈 모델들 일부가 같은 취약점을 찾아내고 익스플로잇 경로를 추론할 수 있었다.
모델 성능은 과제에 따라 크게 달랐으며, FreeBSD 사례는 잘 처리했지만 더 어려운 OpenBSD 문제에서는 한계가 드러났다.
이번 결과는 Anthropic의 보안 특화 모델이 버그 헌팅이나 익스플로잇 분석에서 독보적 우위를 가진다는 주장에 의문을 제기한다.



