Robustness Analysis on Foundational Segmentation Models

Schiappa, Madeline Chantry; Azad, Shehreen; VS, Sachidanand; Ge, Yunhao; Miksik, Ondrej; Rawat, Yogesh S.; Vineet, Vibhav

Computer Science > Computer Vision and Pattern Recognition

arXiv:2306.09278 (cs)

[Submitted on 15 Jun 2023 (v1), last revised 26 Apr 2024 (this version, v2)]

Title:Robustness Analysis on Foundational Segmentation Models

Authors:Madeline Chantry Schiappa, Shehreen Azad, Sachidanand VS, Yunhao Ge, Ondrej Miksik, Yogesh S. Rawat, Vibhav Vineet

View PDF HTML (experimental)

Abstract:Due to the increase in computational resources and accessibility of data, an increase in large, deep learning models trained on copious amounts of multi-modal data using self-supervised or semi-supervised learning have emerged. These ``foundation'' models are often adapted to a variety of downstream tasks like classification, object detection, and segmentation with little-to-no training on the target dataset. In this work, we perform a robustness analysis of Visual Foundation Models (VFMs) for segmentation tasks and focus on robustness against real-world distribution shift inspired perturbations. We benchmark seven state-of-the-art segmentation architectures using 2 different perturbed datasets, MS COCO-P and ADE20K-P, with 17 different perturbations with 5 severity levels each. Our findings reveal several key insights: (1) VFMs exhibit vulnerabilities to compression-induced corruptions, (2) despite not outpacing all of unimodal models in robustness, multimodal models show competitive resilience in zero-shot scenarios, and (3) VFMs demonstrate enhanced robustness for certain object categories. These observations suggest that our robustness evaluation framework sets new requirements for foundational models, encouraging further advancements to bolster their adaptability and performance. The code and dataset is available at: \url{this https URL}.

Comments:	This benchmark along with the code and datasets is available at: this https URL. Accepted at CVPRW 2024
Subjects:	Computer Vision and Pattern Recognition (cs.CV)
Cite as:	arXiv:2306.09278 [cs.CV]
	(or arXiv:2306.09278v2 [cs.CV] for this version)
	https://doi.org/10.48550/arXiv.2306.09278

Submission history

From: Shehreen Azad [view email]
[v1] Thu, 15 Jun 2023 16:59:42 UTC (46,399 KB)
[v2] Fri, 26 Apr 2024 17:51:20 UTC (43,991 KB)

Computer Science > Computer Vision and Pattern Recognition

Title:Robustness Analysis on Foundational Segmentation Models

Submission history

Access Paper:

References & Citations

Bookmark

Bibliographic and Citation Tools

Code, Data and Media Associated with this Article

Demos

Recommenders and Search Tools

arXivLabs: experimental projects with community collaborators

Computer Science > Computer Vision and Pattern Recognition

Title:Robustness Analysis on Foundational Segmentation Models

Submission history

Access Paper:

References & Citations

BibTeX formatted citation

Bookmark

Bibliographic and Citation Tools

Code, Data and Media Associated with this Article

Demos

Recommenders and Search Tools

arXivLabs: experimental projects with community collaborators