NEWVectors or files. Pick a path.Start →

    AI Model Hub

    Browse AI models for multimodal decomposition and recomposition pipelines: plug any model into your extractors.

    15,294 models available

    Showing 817-840 of 15,294 models

    Text Generation

    GSAI-ML/LLaDA-8B-Instruct

    375K
    359
    transformers
    Image Text To Text

    zai-org/GLM-4.6V-Flash

    374K
    619
    transformers
    Text Generation

    trl-internal-testing/tiny-LlamaForCausalLM-3.2

    374K
    1
    transformers
    Automatic Speech Recognition

    pyannote/speaker-diarization

    374K
    1,307
    pyannote-audio
    Image Text To Text

    coolthor/Huihui-Qwen3.6-35B-A3B-abliterated-FP8-DYNAMIC

    373K
    3
    Image Text To Text

    HauhauCS/Qwen3.6-27B-Uncensored-HauhauCS-Aggressive

    372K
    539
    Video Classification

    MCG-NJU/videomae-base

    372K
    55
    transformers
    Sentence Similarity

    nomic-ai/modernbert-embed-base

    371K
    232
    sentence-transformers
    Text To Speech

    bosonai/higgs-tts-3-4b

    370K
    676
    transformers
    Image Text To Text

    bottlecapai/ThinkingCap-Qwen3.6-27B-GGUF

    370K
    196
    gguf
    Automatic Speech Recognition

    handy-computer/Voxtral-Mini-4B-Realtime-2602-gguf

    370K
    1
    transcribe.cpp
    Sentence Similarity

    Alibaba-NLP/gte-base-en-v1.5

    369K
    71
    transformers
    Image Text To Text

    QuantTrio/gemma-4-31B-it-AWQ

    369K
    14
    transformers
    Image Text To Text

    nvidia/NVIDIA-Nemotron-Parse-v1.1

    368K
    171
    transformers
    Text Generation

    nvidia/NVIDIA-Nemotron-Nano-12B-v2

    368K
    164
    transformers
    Automatic Speech Recognition

    alvanlii/wav2vec2-BERT-cantonese

    366K
    6
    transformers
    Any To Any

    openbmb/MiniCPM-o-2_6

    365K
    1,296
    transformers
    Zero Shot Image Classification

    laion/CLIP-ViT-L-14-laion2B-s32B-b82K

    365K
    64
    open_clip
    Text Generation

    allenai/Olmo-3-7B-Instruct-SFT

    365K
    5
    transformers
    Text Generation

    cyankiwi/GLM-4.7-Flash-AWQ-4bit

    362K
    56
    transformers
    Feature Extraction

    jinaai/jina-embeddings-v2-base-en

    362K
    735
    sentence-transformers
    Image Classification

    timm/convnext_femto.d1_in1k

    361K
    1
    timm
    Image Classification

    timm/efficientnet_b2.ra_in1k

    356K
    timm
    Image To Text

    PaddlePaddle/PP-LCNet_x1_0_doc_ori

    356K
    18
    PaddleOCR
    35 / 638