NEWVectors or files. Pick a path.Start →

    AI Model Hub

    Browse AI models for multimodal decomposition and recomposition pipelines: plug any model into your extractors.

    15,294 models available

    Showing 769-792 of 15,294 models

    Automatic Speech Recognition

    eddiegulay/wav2vec2-large-xlsr-mvc-swahili

    408K
    3
    transformers
    Image Classification

    microsoft/swinv2-tiny-patch4-window16-256

    408K
    14
    transformers
    Image To Text

    ibm-granite/granite-vision-3.3-2b

    407K
    85
    Feature Extraction

    facebook/bart-base

    407K
    205
    transformers
    Image To Text

    microsoft/trocr-small-handwritten

    406K
    63
    transformers
    Image Classification

    timm/vit_tiny_r_s16_p8_224.augreg_in21k

    405K
    timm
    Image Text To Text

    Qwen/Qwen3.5-9B-Base

    405K
    97
    transformers
    Automatic Speech Recognition

    software-mansion/react-native-executorch-whisper-tiny

    405K
    1
    Text Generation

    deepreinforce-ai/Ornith-1.0-397B

    403K
    246
    transformers
    Text Generation

    speakleash/Bielik-11B-v3.0-Instruct-awq

    402K
    3
    transformers
    Any To Any

    google/gemma-4-E4B-it-qat-w4a16-ct

    401K
    10
    transformers
    Automatic Speech Recognition

    Revai/reverb-diarization-v1

    401K
    13
    pyannote-audio
    Image Text To Text

    stepfun-ai/GOT-OCR2_0

    401K
    1,548
    Fill Mask

    yiyanghkust/finbert-pretrain

    400K
    40
    transformers
    Image Text To Text

    unsloth/gemma-4-31B-it-unsloth-bnb-4bit

    400K
    22
    Image Text To Text

    OpenGVLab/InternVL3-78B-AWQ

    400K
    10
    transformers
    Feature Extraction

    danielheinz/e5-base-sts-en-de

    399K
    17
    transformers
    Text Generation

    Vikhrmodels/Vikhr-Nemo-12B-Instruct-R-21-09-24

    398K
    141
    transformers
    Text To Speech

    Qwen/Qwen3-TTS-12Hz-0.6B-Base

    397K
    268
    Image Text To Text

    trl-internal-testing/tiny-Gemma3ForConditionalGeneration

    396K
    transformers
    Image To Image

    Qwen/Qwen-Image-Edit-2509

    396K
    1,215
    diffusers
    Text To Speech

    ai4bharat/indic-parler-tts

    396K
    275
    transformers
    Fill Mask

    tohoku-nlp/bert-base-japanese-whole-word-masking

    396K
    76
    transformers
    Text Generation

    nvidia/Kimi-K2.5-NVFP4

    393K
    86
    Model Optimizer
    33 / 638