3DCodeBench: 코드를 통한 에이전트형 절차적 3D 모델링 벤치마킹
3DCodeBench: Benchmarking Agentic Procedural 3D Modeling Via Code
TL;DR AI
1분핵심 요약
연구진은 텍스트와 이미지로부터 절차적 3D 코드를 생성하는 능력을 12개 최신 비전-언어 모델에 대해 평가하는 벤치마크 3DCodeBench를 공개했다.
또한 생성된 3D 결과물을 사람 선호도로 비교·순위화하는 플랫폼 3DCodeArena도 함께 출시했다.
평가 결과, 렌더링이 성공해도 API 불일치 오류와 기하학적 결함이 자주 나타나며 과제가 여전히 어렵다는 점이 확인됐다.
추론 시간을 더 쓰고 반복적으로 다듬을수록 성능이 좋아졌고, 데이터셋·평가 프로토콜·공개 플랫폼도 함께 배포됐다.
