[AI 해커톤 후기] 코드와 문서만 읽은 LLM은 어떻게 사람과 같은 팀을 1위로 골랐을까
[AI Hackathon Review] How Did an LLM That Read Only Code and Documents Pick the Same Team as Humans for First Place?
TL;DR AI
1분핵심 요약
네이버는 전사 AI 해커톤에서 사람이 아니라 LLM이 코드와 문서만 읽고 25개 팀의 MVP를 채점하는 실험을 했다.
평가는 실제 업무를 얼마나 줄였는지에 초점을 두고 기능 완성도, 기술 구현, 차별성, 문서 품질로 나눠 진행됐다.
LLM 심사는 문제별 상위팀 선발과 최종 수상 결정에도 활용됐다.
이번 사례는 코드 실행 없이도 LLM이 결과물의 품질과 업무 기여도를 어느 정도 판별하며 대규모 자동 심사에 쓸 수 있음을 보여준다.