NVIDIA, 고속·고정밀 객체 탐지 AI 모델 ‘LocateAnything’ 공개… 사진뿐 아니라 앱 UI와 문자도 탐지 가능
NVIDIA releases LocateAnything, a high-speed, high-precision object detection AI model that can also detect app UIs and text, not just photos

TL;DR AI
1분핵심 요약
NVIDIA가 사진, 스크린샷, 문서 속 대상을 빠르게 찾아내는 비전-언어 모델 LocateAnything을 공개했다.
이 모델은 UI 요소와 문자 검출도 지원하며, 세밀한 대상 인식에서 Qwen3-VL과 Rex-Omni보다 우수한 성능을 보였다.
Hugging Face에서 데모를 제공하고 있으며, 모델 본체도 공개됐다.
이 기술은 로봇 제어, PC 자동화, UI 분석 등 실시간 인지 작업의 응답성과 정확도를 높일 수 있다.



