safetyfactbearishModelScan only produced definitive security decisions for 49.6% of labeled families, showing limited coverage despite high accuracyModelScan for 67 (49.6%)Artificial Intelligence30 Aug 2026http://arxiv.org/abs/2608.27424v1