PAPER·June 1, 2026Function2Scene: 3D Indoor Scene Layout from Functional SpecificationsHugging Face Papers
PAPER·May 28, 2026TRACER: Turn-level Regret Matching with Inner Reinforcement Credit for Cooperative Multi-LLM ReasoningarXiv
PAPER·May 27, 2026Share More, Search Less: Collaborative Parallel Thinking for Efficient Test-Time ScalingHugging Face Papers
PAPER·May 26, 2026Faithfulness Metrics Don't Measure Faithfulness: A Meta-Evaluation with Ground TruthHugging Face Papers
PAPER·May 22, 2026From Reasoning Chains to Verifiable Subproblems: Curriculum Reinforcement Learning Enables Credit Assignment for LLM ReasoningHugging Face Papers
PAPER·May 21, 2026You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 TrajectoriesHugging Face Papers