언어 바꾸기English
이전 목록

새 벤치마크, AI 영상 생성기는 놀라울 만큼 뛰어나지만 여전히 세상을 추론하지는 못한다는 점 확인

New benchmark confirms AI video generators look stunning but still can't reason about the world

TL;DR AI

핵심 요약

1분
  1. 칭화대 연구진은 AI 영상 모델이 장면을 물리적·사회적·논리적·정보적으로 일관되게 이어가는지 평가하는 WorldReasonBench와 WorldRewardBench를 공개했다.

  2. 평가 결과 상용 모델이 전반적으로 오픈소스 모델보다 더 나았고, Sora 2, Seedance 2.0, Veo 3.1-Fast 등이 상대적으로 강한 성능을 보였다.

  3. 하지만 최고 수준의 모델들조차 논리적 추론과 실제 세계 지식이 필요한 과제에서 가장 큰 약점을 드러냈다.

  4. 이번 결과는 영상이 그럴듯해 보여도 실제 세계를 이해한다는 뜻은 아니며, 복잡한 지시 수행이나 신뢰성 있는 생성에 한계가 있음을 보여준다.

원문 보기