NEWVectors or files. Pick a path.Start →

    Automatic Speech Recognition Models

    Browse AI models for multimodal decomposition and recomposition pipelines: plug any model into your extractors.

    505 models available

    Showing 1-24 of 505 models

    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-japanese

    15.9M
    81
    transformers
    Automatic Speech Recognition

    argmaxinc/whisperkit-coreml

    11.4M
    224
    whisperkit
    Automatic Speech Recognition

    pyannote/speaker-diarization-3.1

    8.7M
    3,599
    pyannote-audio
    Automatic Speech Recognition

    openai/whisper-large-v3-turbo

    6.8M
    3,345
    transformers
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-portuguese

    5.5M
    55
    transformers
    Automatic Speech Recognition

    pyannote/speaker-diarization-community-1

    5.0M
    1,660
    pyannote-audio
    Automatic Speech Recognition

    openai/whisper-large-v3

    4.9M
    6,287
    transformers
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-russian

    3.9M
    76
    transformers
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-polish

    3.6M
    12
    transformers
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-dutch

    3.1M
    17
    transformers
    Automatic Speech Recognition

    openai/whisper-small

    3.0M
    599
    transformers
    Automatic Speech Recognition

    indonesian-nlp/wav2vec2-indonesian-javanese-sundanese

    3.0M
    15
    transformers
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-greek

    2.8M
    4
    transformers
    Automatic Speech Recognition

    Qwen/Qwen3-ASR-1.7B

    2.8M
    1,090
    Automatic Speech Recognition

    MahmoudAshraf/mms-300m-1130-forced-aligner

    2.7M
    103
    transformers
    Automatic Speech Recognition

    Systran/faster-whisper-small

    2.5M
    49
    ctranslate2
    Automatic Speech Recognition

    Systran/faster-whisper-tiny

    2.3M
    26
    ctranslate2
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-hungarian

    2.3M
    10
    transformers
    Automatic Speech Recognition

    mistralai/Voxtral-Mini-4B-Realtime-2602

    2.3M
    979
    vllm
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-arabic

    2.2M
    55
    transformers
    Automatic Speech Recognition

    gigant/romanian-wav2vec2

    1.9M
    8
    transformers
    Automatic Speech Recognition

    KBLab/wav2vec2-large-voxrex-swedish

    1.9M
    13
    transformers
    Automatic Speech Recognition

    mlx-community/parakeet-tdt-0.6b-v3

    1.8M
    57
    mlx
    Automatic Speech Recognition

    anuragshas/wav2vec2-large-xlsr-53-telugu

    1.8M
    5
    transformers
    1 / 22

    All models

    Every model page in one place, 396 in total.