PAPER·3 days agoRevisiting Lossy Verification in Speculative Decoding: Mechanisms, Trade-offs, and Failure ModesarXiv
PAPER·May 28, 2026Fast-dDrive: Efficient Block-Diffusion VLM for Autonomous DrivingHugging Face Papers
TECH·May 27, 2026Meet EAGLE 3.1: The Speculative Decoding Algorithm That Fixes Attention Drift in LLM InferenceMarkTechPost
TECH·May 27, 2026Eagle 3.1: Collaboration Between the EAGLE Team, vLLM Team, and TorchSpec Team | Hacker NewsHacker News
PAPER·May 20, 2026Draft Less, Retrieve More: Hybrid Tree Construction for Speculative DecodingHugging Face Papers
PAPER·May 12, 2026SlimSpec: Low-Rank Draft LM-Head for Accelerated Speculative DecodingHugging Face Papers
PAPER·May 11, 2026SpecBlock: Block-Iterative Speculative Decoding with Dynamic Tree DraftingHugging Face Papers
TECH·May 2, 2026New NVIDIA Research Shows Speculative Decoding in NeMo RL Achieves 1.8× Rollout Generation Speedup at 8B and Projects 2.5× End-to-End Speedup at 235BMarkTechPost
PAPER·April 30, 2026Accelerating RL Post-Training Rollouts via System-Integrated Speculative DecodingHugging Face Papers