언어 바꾸기English
이전 목록

미토스급 모델 공개는 “강력한 안전 조치 후” 앤트로픽이 성과 설명

Anthropic says Mythos-class model will be released “after robust safety measures” as it explains its progress

TL;DR AI

핵심 요약

1분
  1. 앤트로픽은 Project Glasswing을 통해 Mythos급 모델이 1만 건이 넘는 고위험·치명적 취약점을 찾아냈다고 밝혔다.

  2. 회사는 현재 모델을 비공개로 유지하고, 당분간 일부 파트너에게만 공유할 계획이다.

  3. 공개 출시를 위해서는 더 강력한 안전장치와 방어 지침이 먼저 마련돼야 한다고 밝혔다.

  4. 이번 방침은 강력한 AI가 버그 탐지에는 도움이 되지만, 악용 속도도 높일 수 있다는 판단을 반영한다.

원문 보기