언어 바꾸기English
이전 목록

MiniMax-M2 시리즈: 작은 활성화가 현실 세계의 최대 지능을 끌어내다

The MiniMax-M2 Series: Mini Activations Unleashing Max Real-World Intelligence

TL;DR AI

핵심 요약

1분
  1. MiniMax가 에이전트형 작업에 맞춘 M2 계열 Mixture-of-Experts 언어 모델을 공개했다.

  2. 주력 모델 M2는 총 2299억 개 파라미터를 갖지만 토큰당 98억 개만 활성화해 효율성을 높인다.

  3. 학습 체계는 에이전트가 생성한 데이터, Forge 강화학습 프레임워크, 그리고 학습 설정을 스스로 점검·조정할 수 있는 M2.7 체크포인트를 결합했다.

  4. MiniMax는 이 모델들이 코딩, 검색, 오피스 업무, 추론 벤치마크에서 강한 성능을 보인다고 밝혔다.

원문 보기