Hands-on experience building object detection and segmentation models in production: YOLO, SAM (Segment Anything Model), or similar architectures
Solid fundamentals in CNNs, vision transformers, attention mechanisms & multi-scale feature extraction
Required Candidate profile
3-5 years building production computer vision / deep learning systems