PAPER·yesterdayLeveraging External Knowledge for Historical Document Restoration via Retrieval-Augmented Large Language ModelsHugging Face Papers
PAPER·yesterdayOxygen-TryOn: Fashion-Native Foundation Model for Any-item Virtual Try-OnHugging Face Papers
PAPER·yesterdayA Frozen 12B Beats Frontier Models on Verified Work: 100% Accuracy, 0 Tokens, Bit-Exact, ForeverHugging Face Papers
PAPER·yesterdayJarvisHub: An Open Harness for Canvas-Native Multimodal Creative AgentsHugging Face Papers
PAPER·yesterdayDecoupleMix: Decoupled Ratio Search and Convex Allocation for Scalable VLM Data RecipesHugging Face Papers
PAPER·yesterdayFrom Proprietary to Open-Source: Bridging the Distribution Gap via Multi-Agent Protocol Distillation in Agentic SearchHugging Face Papers
PAPER·yesterdayOmniVAE: An Audio-Video VAE with Cross-Modal Alignment for Joint GenerationHugging Face Papers
PAPER·yesterdayClinFusion: A Vision-Centric Multimodal LLM System for Holistic Medical UnderstandingHugging Face Papers
PAPER·yesterdayProgress Reward Modeling for Robotic Learning: A Comprehensive SurveyHugging Face Papers
PAPER·yesterdayDriveDNA: A Large-Scale Multimodal Naturalistic Driving Dataset and Benchmark for Driving Style IdentificationHugging Face Papers