Back to papers
July 30, 2026cs.AIcs.CLcs.LG

WIDE: Boosting Adaptive LLM Inference via Token-level Dynamic Width Pruning

Categories

cs.AI, cs.CL, cs.LG