본문으로 건너뛰기
트렌드 검색
검색
언어 바꾸기
English
“MultimodalAI” 검색 결과
카테고리 설정
인기
최신
테크
코딩
사이언스
게이밍
영상
투자
논문
하드웨어
검색된 기사
제목
요약
태그
날짜
적용
논문
·
2026년 5월 28일
OmniVerifier-M1: 명시적 구조화 재보정이 적용된 멀티모달 메타 검증기
Hugging Face Papers
논문
·
2026년 5월 28일
픽셀에서 단어로 -- 대규모 네이티브 원비전 모델을 향하여
Hugging Face Papers
논문
·
2026년 5월 27일
Gemini Embedding 2: Gemini 기반 네이티브 멀티모달 임베딩 모델
Hugging Face Papers
논문
·
2026년 5월 27일
LLaVA-OneVision-2: 차세대 지각 지능을 향하여
Hugging Face Papers
논문
·
2026년 5월 26일
비전-언어 모델의 머신 언러닝 강건성에 대하여
arXiv
테크
·
2026년 5월 26일
씨댄스는 잊어라: 구글의 Gemini Omni가 AI 비디오의 미래인 이유
Geeky Gadgets
논문
·
2026년 5월 26일
MetaphorVU: 은유적 비디오 이해를 향하여
Hugging Face Papers
논문
·
2026년 5월 25일
LatentUMM: 통합 멀티모달 모델을 위한 이중 잠재 정렬
Hugging Face Papers
테크
·
2026년 5월 24일
ByteDance 연구, LMM에 긴 문서 학습에서 텍스트를 받아쓰게 하는 것보다 질문하는 방식이 더 효과적이라고 밝혀
THE DECODER
논문
·
2026년 5월 23일
VGenST-Bench: 능동적 비디오 합성을 통한 시공간 추론 벤치마크
Hugging Face Papers
테크
·
2026년 5월 23일
구글, AI 영상의 클립 생성에서 제작으로의 전환 신호
Forbes
테크
·
2026년 5월 23일
AI 영상 경쟁은 더 이상 보기 좋은 클립에만 머물지 않는다
Forbes
이전
2페이지
다음
트렌드
대시보드
리포트