NEWVectors or files. Pick a path.Start →

    Automatic Speech Recognition Models

    Browse AI models for multimodal decomposition and recomposition pipelines: plug any model into your extractors.

    491 models available

    Showing 1-24 of 491 models

    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-japanese

    12.0M
    62
    transformers
    Automatic Speech Recognition

    argmaxinc/whisperkit-coreml

    11.6M
    204
    whisperkit
    Automatic Speech Recognition

    pyannote/speaker-diarization-3.1

    9.7M
    3,249
    pyannote-audio
    Automatic Speech Recognition

    openai/whisper-large-v3-turbo

    7.3M
    3,275
    transformers
    Automatic Speech Recognition

    pyannote/speaker-diarization-community-1

    5.2M
    1,214
    pyannote-audio
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-portuguese

    4.9M
    55
    transformers
    Automatic Speech Recognition

    openai/whisper-large-v3

    4.8M
    6,205
    transformers
    Automatic Speech Recognition

    Qwen/Qwen3-ASR-1.7B

    4.6M
    1,048
    Automatic Speech Recognition

    pyannote/voice-activity-detection

    4.4M
    241
    pyannote-audio
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-russian

    3.7M
    76
    transformers
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-polish

    3.2M
    12
    transformers
    Automatic Speech Recognition

    openai/whisper-small

    3.0M
    585
    transformers
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-dutch

    2.7M
    17
    transformers
    Automatic Speech Recognition

    indonesian-nlp/wav2vec2-indonesian-javanese-sundanese

    2.6M
    15
    transformers
    Automatic Speech Recognition

    MahmoudAshraf/mms-300m-1130-forced-aligner

    2.5M
    101
    transformers
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-greek

    2.3M
    4
    transformers
    Automatic Speech Recognition

    mlx-community/parakeet-tdt-0.6b-v2

    2.2M
    47
    mlx
    Automatic Speech Recognition

    mistralai/Voxtral-Mini-4B-Realtime-2602

    2.2M
    956
    vllm
    Automatic Speech Recognition

    Systran/faster-whisper-small

    2.0M
    46
    ctranslate2
    Automatic Speech Recognition

    handy-computer/nemotron-3.5-asr-streaming-0.6b-gguf

    1.9M
    5
    transcribe.cpp
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-hungarian

    1.9M
    10
    transformers
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-arabic

    1.9M
    55
    transformers
    Automatic Speech Recognition

    Systran/faster-whisper-tiny

    1.9M
    24
    ctranslate2
    Automatic Speech Recognition

    openai/whisper-base

    1.8M
    287
    transformers
    1 / 21

    All models

    Every model page in one place, 374 in total.