AI Model Hub
Browse AI models for multimodal decomposition and recomposition pipelines — plug any model into your extractors.
14,911 models available
Showing 1–24 of 14,911 models
Featured Models
Benchmarked
HFVisual Embeddings
openai/clip-vit-large-patch14
Contrastive Language-Image Pre-Training for zero-shot visual understanding
12.0M
3 benchmarks
HFVisual Embeddings
google/siglip-base-patch16-224
Sigmoid Loss for Language Image Pre-Training, efficient contrastive learning
1.5M
3 benchmarks
HFVisual Embeddings
google/siglip2-giant-opt-patch16-384
Multilingual vision-language encoder with dense features and localization
1.6M
2 benchmarks
HFVisual Embeddings
facebook/dinov2-large
Self-supervised vision foundation model producing all-purpose visual features
968K
2 benchmarks
PyTorchVisual Embeddings
facebook/dinov3-large
Next-generation self-supervised vision model with Gram anchoring and 6.7B scaling
450K
1 benchmarks
HFVisual Embeddings
laion/CLIP-ViT-bigG-14-laion2B-39B-b160k
Open-source CLIP trained on 2B image-text pairs at giant scale
109K
2 benchmarks
Sentence Similarity
sentence-transformers/all-MiniLM-L6-v2
248.5M
5,093
sentence-transformersSentence Similarity
sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2
48.9M
1,325
sentence-transformersSentence Similarity
sentence-transformers/all-mpnet-base-v2
29.7M
1,332
sentence-transformers...
1 / 622