본문으로 건너뛰기
toldrop
트렌드 검색
검색
“비전언어모델” 검색 결과
카테고리 설정
최신
테크
코딩
사이언스
게이밍
영상
투자
논문
하드웨어
검색된 기사
논문
·
19시간 전
로보스트랄 내비게이트
Hugging Face Papers
논문
·
그저께
보여주고 말하라: LLM 텍스트가 아닌 생성형 픽셀에서 공간 인지 평가하기
Hugging Face Papers
논문
·
그저께
비주얼 대조 자기 증류
Hugging Face Papers
논문
·
그저께
암시적·명시적 기하를 활용한 3D 인식 VLM
arXiv
논문
·
그저께
추론 기반 가드레일은 언제 비효율적인가? ResponseGuard: 실시간 모더레이션을 위한 빠른 비전-언어 가드
arXiv
논문
·
2026년 6월 2일
PARCEL: 조건부 탄성 쿼리를 활용한 풀 앵커 리샘플링 기반 효율적 비전-언어 이해
Hugging Face Papers
논문
·
2026년 6월 2일
VLM은 적응형 테스트 시간 최적화를 통해 비디오 추론을 가르치는 좋은 교사다
arXiv
논문
·
2026년 6월 1일
임베딩 모델은 개념을 어떻게 결합할 수 있을까?
Hugging Face Papers
논문
·
2026년 6월 1일
평면 조립 벤치: 가구 조립을 통한 대규모 비전-언어 모델의 시공간 이해 평가
Hugging Face Papers
논문
·
2026년 6월 1일
보는 것이 아는 것은 아니다: VLM은 언제 공간 질문에 답하지 말아야 하는지(그리고 왜인지) 알고 있는가?
Hugging Face Papers
논문
·
2026년 6월 1일
VLM3: 비전-언어 모델은 본질적으로 3D 학습자다
Hugging Face Papers
논문
·
2026년 5월 30일
Why Far Looks Up: 비전-언어 모델의 공간 표현 탐구
Hugging Face Papers
1페이지
다음
트렌드
리포트