NEWVectors or files. Pick a path.Start →

    Image To Text Models

    Browse AI models for multimodal decomposition and recomposition pipelines: plug any model into your extractors.

    536 models available

    Showing 457-480 of 536 models

    Image To Text

    Kansallisarkisto/cyrillic-large-handwritten-onnx

    227
    Image To Text

    noctrex/Pixtral-12B-Captioner-Relaxed-GGUF

    226
    Image To Text

    KrorngAI/TrorYongOCR

    224
    2
    Image To Text

    paran3xus/typress_ocr

    223
    3
    transformers
    Image To Text

    doeu/llava-next-mango-disease-sft-multi-0.5ep-lr2e5-v1

    223
    Image To Text

    DunnBC22/trocr-base-printed_license_plates_ocr

    222
    11
    transformers
    Image To Text

    PaddlePaddle/PP-LCNet_x1_0_table_cls_onnx

    222
    PaddleOCR
    Image To Text

    Z3NN001/gemma4-21b-a4b-REAP-it-mlx-Q4

    220
    4
    mlx
    Image To Text

    noctrex/UI-Venus-1.5-2B-GGUF

    219
    2
    Image To Text

    loay/Arabic-OCR-Qwen2.5-VL-7B-Vision

    219
    5
    transformers
    Image To Text

    cyberagent/llava-calm2-siglip

    218
    26
    transformers
    Image To Text

    Mungert/LightOnOCR-1B-1025-GGUF

    218
    1
    vllm
    Image To Text

    PaddlePaddle/RT-DETR-H_layout_17cls

    217
    2
    PaddleOCR
    Image To Text

    mradermacher/Hulu-Med-Flash-Preview-27B-GGUF

    216
    transformers
    Image To Text

    PaddlePaddle/RT-DETR-L_wireless_table_cell_det_onnx

    216
    1
    PaddleOCR
    Image To Text

    EZCon/GLM-OCR-8bit-mlx

    215
    1
    mlx
    Image To Text

    WafaaFraih/blip-roco-radiology-captioning

    215
    3
    transformers
    Image To Text

    onnx-community/manga-ocr-base-ONNX

    214
    transformers.js
    Image To Text

    nebulette/tipsv2-b14-tagger

    214
    Image To Text

    samuraieng/sarashina2.2-vision-3b-gguf

    208
    1
    Image To Text

    PaddlePaddle/SLANeXt_wired_safetensors

    208
    1
    PaddleOCR
    Image To Text

    livadies/gemma-4-31B-Ghetto-NF4

    207
    6
    transformers
    Image To Text

    Ertugrul/Qwen2-VL-7B-Captioner-Relaxed

    207
    64
    transformers
    Image To Text

    microsoft/git-base-textcaps

    206
    9
    transformers
    20 / 23

    All models

    Every model page in one place, 375 in total.