Open-Set Recognition in the Age of Vision-Language Models | allainews.com

March 26, 2024, 4:47 a.m. | Dimity Miller, Niko S\"underhauf, Alex Kenna, Keita Mason

cs.CV updates on arXiv.org arxiv.org

arXiv:2403.16528v1 Announce Type: new
Abstract: Are vision-language models (VLMs) open-set models because they are trained on internet-scale datasets? We answer this question with a clear no - VLMs introduce closed-set assumptions via their finite query set, making them vulnerable to open-set conditions. We systematically evaluate VLMs for open-set recognition and find they frequently misclassify objects not contained in their query set, leading to alarmingly low precision when tuned for high recall and vice versa. We show that naively increasing the …

abstract age arxiv assumptions clear cs.cv datasets internet language language models making query question recognition scale set them type via vision vision-language models vlms vulnerable

More from arxiv.org / cs.CV updates on arXiv.org

3D Human Pose Perception from Egocentric Stereo Videos 23 hours ago | arxiv.org

abstract arxiv compact cs.cv +11

SqueezeSAM: User friendly mobile interactive segmentation 23 hours ago | arxiv.org

abstract architecture arxiv computational +21

Polarimetric Light Transport Analysis for Specular Inter-reflection 23 hours ago | arxiv.org

abstract analysis arxiv cs.cv +13

Density-Guided Dense Pseudo Label Selection For Semi-supervised Oriented Object Detection 23 hours ago | arxiv.org

arxiv cs.cv detection object +4

CtxMIM: Context-Enhanced Masked Image Modeling for Remote Sensing Image Understanding 23 hours ago | arxiv.org

abstract arxiv clear context +19

nnSAM: Plug-and-play Segment Anything Model Improves nnUNet Performance 23 hours ago | arxiv.org

abstract arxiv clinical cs.cv +21

CoFiI2P: Coarse-to-Fine Correspondences for Image-to-Point Cloud Registration 23 hours ago | arxiv.org

arxiv cloud cs.ai cs.cv +5

Detail Reinforcement Diffusion Model: Augmentation Fine-Grained Visual Categorization in Few-Shot Conditions 23 hours ago | arxiv.org

abstract annotated data arxiv augmentation +18

Generative Image Dynamics 23 hours ago | arxiv.org

abstract arxiv clothes collection +15

Software Engineer for AI Training Data (School Specific)

@ G2i Inc | Remote

View on ai-jobs.net

Software Engineer for AI Training Data (Python)

@ G2i Inc | Remote

View on ai-jobs.net

Software Engineer for AI Training Data (Tier 2)

@ G2i Inc | Remote

View on ai-jobs.net

Data Engineer

@ Lemon.io | Remote: Europe, LATAM, Canada, UK, Asia, Oceania

View on ai-jobs.net

Artificial Intelligence – Bioinformatic Expert

@ University of Texas Medical Branch | Galveston, TX

View on ai-jobs.net

Lead Developer (AI)

@ Cere Network | San Francisco, US

View on ai-jobs.net