언어 바꾸기English
이전 목록

미니맥스, 텍스트·오디오 통합 멀티모달 영상 AI 'H3' 공개... "오픈웨이트로 시댄스에 도전"

MiniMax unveils H3, a multimodal video AI integrating text and audio... "Challenges Sora with open weights"

TL;DR AI

핵심 요약

1분
  1. 미니맥스가 멀티모달 영상 생성 모델 H3를 Hailuo 플랫폼과 개발자 API로 공개했다.

  2. H3는 텍스트·이미지·영상·오디오를 함께 입력받아 최대 15초의 2K 영상을 생성하며, 편집·모션 전송·음성·스테레오 사운드도 지원한다.

  3. 아티피셜 애널리시스 벤치마크에서 영상 편집 1위, 텍스트-영상 2위, 이미지-영상 3위를 기록했다.

  4. 미니맥스는 곧 모델 가중치를 커뮤니티 라이선스로 공개할 계획이며, 경쟁 모델보다 낮은 가격을 내세우고 있다.

  5. 오픈웨이트와 중국산 AI 반도체까지 고려한 설계로, 폐쇄형 중심의 생성형 영상 AI 시장에 도전장을 던졌다.

원문 보기