NEWVectors or files. Pick a path.Start →

    Text To Audio Models

    Browse AI models for multimodal decomposition and recomposition pipelines: plug any model into your extractors.

    550 models available

    Showing 1-24 of 550 models

    Text To Audio

    facebook/musicgen-medium

    1.9M
    167
    transformers
    Text To Audio

    audio-cpp/MiniMax-Music3-GGUF

    172K
    14
    audio.cpp
    Text To Audio

    facebook/musicgen-small

    169K
    509
    transformers
    Text To Audio

    stabilityai/stable-audio-3-medium

    91K
    292
    stable-audio-3
    Text To Audio

    facebook/musicgen-large

    89K
    539
    transformers
    Text To Audio

    ACE-Step/Ace-Step1.5

    55K
    844
    transformers
    Text To Audio

    CaptainArni/audio.cpp-gguf

    31K
    gguf
    Text To Audio

    MiniMaxAI/MiniMax-Music3

    25K
    1,353
    diffusers
    Text To Audio

    alakxender/mms-tts-div-finetuned-md-f01

    24K
    transformers
    Text To Audio

    facebook/musicgen-melody

    22K
    259
    transformers
    Text To Audio

    stabilityai/stable-audio-3-small-sfx

    21K
    100
    stable-audio-3
    Text To Audio

    stabilityai/stable-audio-open-1.0

    20K
    1,596
    stable-audio-tools
    Text To Audio

    molbal/Minimax-Music3-GGUF

    17K
    1
    Text To Audio

    stabilityai/stable-audio-3-small-music

    13K
    127
    stable-audio-3
    Text To Audio

    stabilityai/stable-audio-3-optimized

    12K
    42
    stable-audio-3
    Text To Audio

    ACE-Step/acestep-5Hz-lm-4B

    10K
    53
    transformers
    Text To Audio

    espnet/fastspeech2_conformer

    9K
    7
    transformers
    Text To Audio

    Abiray/MiniMax-Music3-GGUF

    9K
    33
    Text To Audio

    ACE-Step/acestep-5Hz-lm-0.6B

    9K
    18
    transformers
    Text To Audio

    espnet/fastspeech2_conformer_with_hifigan

    8K
    1
    transformers
    Text To Audio

    google/magenta-realtime-2

    7K
    245
    magenta-realtime-2
    Text To Audio

    ACE-Step/acestep-v15-xl-sft

    6K
    96
    transformers
    Text To Audio

    stabilityai/stable-audio-3-medium-base

    6K
    24
    stable-audio-3
    Text To Audio

    ChrisColeTech/minimax-music3-GGUF

    6K
    11
    gguf
    1 / 23

    All models

    Every model page in one place, 375 in total.