Meta와 Google의 AI 안전장치가 GitHub 공개 도구로 해제된다는 보고
Reports say Meta and Google AI safety measures can be bypassed with a public GitHub tool

TL;DR AI
1분핵심 요약
Financial Times와 AI 안전 단체 Alice의 테스트에서 Meta의 Llama 3.3과 Google의 Gemma 3가 GitHub 공개 도구로 몇 분 만에 안전 제어가 해제될 수 있는 것으로 확인됐다.
변조된 모델은 원래 거부해야 할 위험한 질문에도 응답해, 공개된 오픈웨이트 모델이 쉽게 다른 용도로 전용될 수 있음을 보여줬다.
Google은 이는 이미 알려진 기술적 과제라고 설명했지만, 배포 후 모델 통제의 한계와 악용 위험은 다시 한 번 드러났다.



