NEWVectors or files. Pick a path.Start →

    Text To Audio Models

    Browse AI models for multimodal decomposition and recomposition pipelines: plug any model into your extractors.

    470 models available

    Showing 1-24 of 470 models

    Text To Audio

    facebook/musicgen-medium

    2.0M
    164
    transformers
    Text To Audio

    facebook/musicgen-small

    307K
    499
    transformers
    Text To Audio

    facebook/musicgen-large

    62K
    535
    transformers
    Text To Audio

    ACE-Step/Ace-Step1.5

    60K
    807
    transformers
    Text To Audio

    stabilityai/stable-audio-3-medium

    39K
    244
    stable-audio-3
    Text To Audio

    ACE-Step/acestep-5Hz-lm-4B

    28K
    51
    transformers
    Text To Audio

    ACE-Step/acestep-captioner

    27K
    64
    transformers
    Text To Audio

    stabilityai/stable-audio-open-1.0

    18K
    1,540
    stable-audio-tools
    Text To Audio

    stabilityai/stable-audio-3-small-music

    14K
    101
    stable-audio-3
    Text To Audio

    stabilityai/stable-audio-3-medium-base

    14K
    24
    stable-audio-3
    Text To Audio

    pother/mms-tts-finetune-tha

    14K
    1
    transformers
    Text To Audio

    ACE-Step/acestep-v15-base

    14K
    67
    transformers
    Text To Audio

    stabilityai/stable-audio-3-small-sfx

    13K
    71
    stable-audio-3
    Text To Audio

    facebook/musicgen-melody

    11K
    255
    transformers
    Text To Audio

    google/magenta-realtime-2

    8K
    237
    magenta-realtime-2
    Text To Audio

    ACE-Step/acestep-5Hz-lm-0.6B

    7K
    18
    transformers
    Text To Audio

    ACE-Step/acestep-v15-xl-sft

    5K
    90
    transformers
    Text To Audio

    facebook/musicgen-stereo-large

    4K
    97
    transformers
    Text To Audio

    espnet/fastspeech2_conformer

    4K
    7
    transformers
    Text To Audio

    eustlb/higgs-audio-v2-generation-3B-base

    4K
    1
    transformers
    Text To Audio

    ACE-Step/acestep-v15-xl-turbo

    4K
    190
    transformers
    Text To Audio

    declare-lab/mustango

    4K
    41
    transformers
    Text To Audio

    ilintar/thinksound-gguf

    4K
    1
    Text To Audio

    espnet/fastspeech2_conformer_with_hifigan

    3K
    1
    transformers
    1 / 20