Paper·July 29, 2026Detecting Knowledge Inconsistencies Across Text, Tables, and Knowledge GraphsarXiv
Paper·July 24, 2026LEAD: Breaking the No-Recovery Bottleneck in Long-Horizon ReasoningApple Machine Learning Research
Paper·June 1, 2026Function2Scene: 3D Indoor Scene Layout from Functional SpecificationsHugging Face Papers
Paper·May 28, 2026TRACER: Turn-level Regret Matching with Inner Reinforcement Credit for Cooperative Multi-LLM ReasoningarXiv
Paper·May 27, 2026Share More, Search Less: Collaborative Parallel Thinking for Efficient Test-Time ScalingHugging Face Papers
Paper·May 26, 2026Faithfulness Metrics Don't Measure Faithfulness: A Meta-Evaluation with Ground TruthHugging Face Papers
Paper·May 22, 2026From Reasoning Chains to Verifiable Subproblems: Curriculum Reinforcement Learning Enables Credit Assignment for LLM ReasoningHugging Face Papers
Paper·May 21, 2026You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 TrajectoriesHugging Face Papers
Paper·May 21, 2026You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 TrajectoriesarXiv