CryptanalysisBench, LLM의 암호분석 역량을 측정하는 프레임워크 공개
CryptanalysisBench Introduces a Framework to Measure LLM Cryptanalysis Capabilities

TL;DR AI
1분핵심 요약
연구진이 대형 언어 모델의 암호분석 능력을 측정하기 위한 3단계 벤치마크 ‘CryptanalysisBench’를 공개했다.
이 벤치마크는 이미 알려진 실용적 공격, 실서비스 수준의 암호 원시, 최전선 난제까지 아우른다.
Claude Opus 4.8, Sonnet 5, Mythos 5, GPT-5.5, GLM 5.2 등 여러 모델은 쉬운 과제나 축소된 문제에서는 훨씬 더 좋은 성능을 보였다.
이 도구는 암호 취약점을 찾아내는 능력을 체계적으로 추적해 방어 연구와 위험 평가에 도움을 줄 수 있다.

