PAPER·2 days agoReToken: One Token to Improve Vision-Language Models for Visual RetrievalHugging Face Papers
PAPER·3 days agoMemory Decoder at Scale: A Pretrained, Parametric Long-Term MemoryHugging Face Papers
PAPER·3 days agoSpatialCLI: Learning to Reason With Spatial Tools, Then Without ThemHugging Face Papers
PAPER·3 days agoOVEarth-Bench: Evaluating Category Breadth and Query Diversity for Open-Vocabulary Earth ObservationHugging Face Papers
PAPER·3 days agoWould You Walk to the Car Wash? Revealing the Salience Bias of Large Language Models in Commonsense ReasoningarXiv
PAPER·3 days agoWhen Derived Measurements Mislead: Quantifying and Mitigating LLM Over-Trust with Privileged-Modality Reliability EvidencearXiv
PAPER·3 days agoLEEPS: Latent-Guided Explore-Exploit Prompt Sampling for Efficient RLVR in Large Language ModelsarXiv
PAPER·4 days agoCLBench-V: Evaluating Multimodal Context Learning from Grounding to Knowledge AcquisitionHugging Face Papers