multimodalcritiqueneutralExisting training-free visual token pruning methods suffer from prematurely discarding tokens essential for deep-layer reasoning due to reliance on static, instantaneous heuristicsComputer Vision02 Aug 2026http://arxiv.org/abs/2607.28341v1