SigLIP-2

Google DeepMind · 2025-02 · image, text · discriminative · anchor

Successor to SigLIP, adding captioning-based pretraining and self-distillation objectives to the sigmoid loss.

Variants
SigLIP-2 ViT-B/32, SigLIP-2 ViT-B/16, SigLIP-2 ViT-L/16

Findings

Shared mechanisms