NEWVectors or files. Pick a path.Start →

    Image To Text Models

    Browse AI models for multimodal decomposition and recomposition pipelines: plug any model into your extractors.

    536 models available

    Showing 289-312 of 536 models

    Image To Text

    mradermacher/EraX-VL-7B-V1.5-GGUF

    416
    4
    transformers
    Image To Text

    AbteeXAILab/lumynax-doc-nougat-base

    413
    transformers
    Image To Text

    AbteeXAILab/lumynax-doc-donut-base

    413
    transformers
    Image To Text

    mradermacher/Rax-4.5-GGUF

    411
    5
    transformers
    Image To Text

    uchihamadara1816/TROCR-Chess

    410
    1
    transformers
    Image To Text

    nyu-visionx/Cambrian-S-3B

    409
    1
    transformers
    Image To Text

    xtuner/llava-phi-3-mini-hf

    402
    53
    transformers
    Image To Text

    Xenova/nougat-small

    402
    5
    transformers.js
    Image To Text

    Axway/Rukopys-OCR-4B-GGUF

    402
    2
    Image To Text

    mradermacher/Qwen2-VL-2B-Abliterated-Caption-it-i1-GGUF

    401
    transformers
    Image To Text

    xingxm/HiVG-3B-Base

    397
    11
    transformers
    Image To Text

    unum-cloud/uform-gen2-qwen-500m

    396
    86
    transformers
    Image To Text

    thesimonharms/trocr-javanese-synthetic-v2

    396
    transformers
    Image To Text

    hezarai/crnn-fa-license-plate-recognition

    393
    10
    hezar
    Image To Text

    PaddlePaddle/arabic_PP-OCRv3_mobile_rec

    392
    4
    PaddleOCR
    Image To Text

    PaddlePaddle/PP-DocLayout_plus-L_onnx

    392
    PaddleOCR
    Image To Text

    PaddlePaddle/cyrillic_PP-OCRv5_mobile_rec

    390
    PaddleOCR
    Image To Text

    mradermacher/Megalodon-OCR-Sync-0713-i1-GGUF

    390
    1
    transformers
    Image To Text

    mradermacher/EraX-VL-2B-V1.5-GGUF

    388
    transformers
    Image To Text

    mradermacher/dots.ocr-i1-GGUF

    387
    3
    transformers
    Image To Text

    Felldude/Ministral-3-8B-Uncensored-FP8

    386
    6
    transformers
    Image To Text

    cstr/flova-omr-GGUF

    384
    1
    gguf
    Image To Text

    PaddlePaddle/PP-OCRv4_server_rec_doc

    379
    2
    PaddleOCR
    Image To Text

    tuman/vit-rugpt2-image-captioning

    378
    13
    transformers
    13 / 23

    All models

    Every model page in one place, 375 in total.