A semantic segmentation model using Swin-Tiny backbone, trained on Cityscapes for pixel-level scene labeling.