multimodalcritiquebearishDescriptor-free visual localization accuracy still lags far behind descriptor-based pipelines due to insufficient geometric discriminability in geometry-only matchingComputer Vision27 Jul 2026http://arxiv.org/abs/2607.02486v1