multimodal
fact
bullish
Cross-Modal Joint Confidence Calibration using global visual prototypes can improve text-driven known-class predictions in object detection
Cross-Modal Joint Confidence Calibration injects global visual prototypes to calibrate text-driven known-class predictions
Computer Vision30 Aug 2026