multimodal
fact
bullish
UniD can jointly predict eight dense scene properties (depth, surface normals, semantic segmentation, boundaries, human parts, albedo, shading, and materials) from disjoint, domain-specific datasets without requiring annotation overlap or pseudo-labeling
Computer Vision29 Jul 2026