PAPER·3 days agoMage-VL: An Efficient Codec-Native Streaming Multimodal Foundation ModelHugging Face Papers
PAPER·July 23, 2026MVEI & EmObserver: Empowering MLLM-Oriented Visual Emotional Intelligence via Emotion Statement JudgementarXiv