NEWVectors or files. Pick a path.Start →

    Automatic Speech Recognition Models

    Browse AI models for multimodal decomposition and recomposition pipelines: plug any model into your extractors.

    461 models available

    Showing 1-24 of 461 models

    Automatic Speech Recognition

    pyannote/speaker-diarization-3.1

    8.7M
    2,852
    pyannote-audio
    Automatic Speech Recognition

    openai/whisper-large-v3-turbo

    8.4M
    3,189
    transformers
    Automatic Speech Recognition

    argmaxinc/whisperkit-coreml

    7.8M
    199
    whisperkit
    Automatic Speech Recognition

    openai/whisper-base

    6.5M
    279
    transformers
    Automatic Speech Recognition

    openai/whisper-large-v3

    6.0M
    5,987
    transformers
    Automatic Speech Recognition

    pyannote/speaker-diarization-community-1

    5.2M
    860
    pyannote-audio
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-portuguese

    3.6M
    55
    transformers
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-russian

    3.4M
    75
    transformers
    Automatic Speech Recognition

    pyannote/voice-activity-detection

    3.4M
    239
    pyannote-audio
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-polish

    2.6M
    12
    transformers
    Automatic Speech Recognition

    openai/whisper-small

    2.5M
    575
    transformers
    Automatic Speech Recognition

    MahmoudAshraf/mms-300m-1130-forced-aligner

    2.5M
    94
    transformers
    Automatic Speech Recognition

    Systran/faster-whisper-small

    2.0M
    40
    ctranslate2
    Automatic Speech Recognition

    mistralai/Voxtral-Mini-4B-Realtime-2602

    2.0M
    929
    vllm
    Automatic Speech Recognition

    openai/whisper-tiny

    1.8M
    436
    transformers
    Automatic Speech Recognition

    Qwen/Qwen3-ASR-1.7B

    1.8M
    948
    Automatic Speech Recognition

    mlx-community/parakeet-tdt-0.6b-v2

    1.8M
    45
    mlx
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-dutch

    1.7M
    16
    transformers
    Automatic Speech Recognition

    handy-computer/nemotron-3.5-asr-streaming-0.6b-gguf

    1.7M
    2
    transcribe.cpp
    Automatic Speech Recognition

    distil-whisper/distil-large-v3

    1.7M
    376
    transformers
    Automatic Speech Recognition

    handy-computer/parakeet-unified-en-0.6b-gguf

    1.5M
    2
    transcribe.cpp
    Automatic Speech Recognition

    facebook/wav2vec2-base-960h

    1.5M
    400
    transformers
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-japanese

    1.5M
    62
    transformers
    Automatic Speech Recognition

    Qwen/Qwen3-ASR-0.6B

    1.5M
    322
    1 / 20