multimodalcritiqueneutralExisting post-training quantization methods for Vision Transformers use uniform bit-widths and overlook heterogeneous sensitivity to quantization, leading to inefficient precision allocationMachine Learning02 Aug 2026http://arxiv.org/abs/2607.28589v1