NEWVectors or files. Pick a path.Start →

    Image Text To Text Models

    Browse AI models for multimodal decomposition and recomposition pipelines: plug any model into your extractors.

    681 models available

    Showing 145-168 of 681 models

    Image Text To Text

    unsloth/gemma-4-31B-it-unsloth-bnb-4bit

    400K
    22
    Image Text To Text

    OpenGVLab/InternVL3-78B-AWQ

    400K
    10
    transformers
    Image Text To Text

    trl-internal-testing/tiny-Gemma3ForConditionalGeneration

    396K
    transformers
    Image Text To Text

    kakaocorp/kanana-1.5-v-3b-instruct

    390K
    56
    transformers
    Image Text To Text

    typhoon-ai/typhoon-ocr-3b

    389K
    9
    transformers
    Image Text To Text

    ATH-MaaS/Ovis2.5-9B

    386K
    308
    transformers
    Image Text To Text

    moonshotai/Kimi-VL-A3B-Instruct

    380K
    275
    transformers
    Image Text To Text

    unsloth/Kimi-K2.7-Code-GGUF

    376K
    185
    transformers
    Image Text To Text

    zai-org/GLM-4.6V-Flash

    374K
    619
    transformers
    Image Text To Text

    coolthor/Huihui-Qwen3.6-35B-A3B-abliterated-FP8-DYNAMIC

    373K
    3
    Image Text To Text

    HauhauCS/Qwen3.6-27B-Uncensored-HauhauCS-Aggressive

    372K
    539
    Image Text To Text

    bottlecapai/ThinkingCap-Qwen3.6-27B-GGUF

    370K
    196
    gguf
    Image Text To Text

    QuantTrio/gemma-4-31B-it-AWQ

    369K
    14
    transformers
    Image Text To Text

    nvidia/NVIDIA-Nemotron-Parse-v1.1

    368K
    171
    transformers
    Image Text To Text

    empero-ai/Qwythos-9B-v2-GGUF

    355K
    219
    gguf
    Image Text To Text

    Qwen/Qwen2.5-VL-3B-Instruct-AWQ

    351K
    64
    transformers
    Image Text To Text

    RedHatAI/gemma-4-31B-it-FP8-dynamic

    350K
    23
    transformers
    Image Text To Text

    OpenVINO/Phi-3.5-vision-instruct-int8-ov

    347K
    2
    Image Text To Text

    RedHatAI/gemma-3-27b-it-quantized.w4a16

    346K
    13
    transformers
    Image Text To Text

    internlm/Intern-S1-Pro

    345K
    279
    transformers
    Image Text To Text

    amd/MiniMax-M3-MXFP4

    329K
    4
    transformers
    Image Text To Text

    HuggingFaceTB/SmolVLM-500M-Instruct

    325K
    196
    transformers
    Image Text To Text

    cyankiwi/diffusiongemma-26B-A4B-it-AWQ-INT4

    314K
    2
    transformers
    Image Text To Text

    Qwen/Qwen2.5-VL-72B-Instruct-AWQ

    310K
    73
    transformers
    7 / 29