NEWVectors or files. Pick a path.Start →
    Multimodal Search

    Multimodal Search with Fusion

    Combines text and image embeddings using RRF fusion for comprehensive multimodal search.

    No credit card to start · Build from $25/mo

    Pipeline Stages

    1
    multimodal_search
    filter
    feature_search
    View parameters
    {
      "searches": [
        {
          "feature_uri": "mixpeek://text_extractor@v1/multilingual_e5_large_instruct_v1",
          "query": {
            "input_mode": "text",
            "value": "{{INPUT.query}}"
          },
          "top_k": 100
        },
        {
          "feature_uri": "mixpeek://image_extractor@v1/google_siglip_base_v1",
          "query": {
            "input_mode": "text",
            "value": "{{INPUT.query}}"
          },
          "top_k": 50
        }
      ],
      "final_top_k": 25,
      "fusion": "rrf"
    }

    Input Schema

    query
    text
    required

    Multimodal search query

    e.g. sunset over mountains

    Use Cases

    • E-commerce visual search
    • Media library search
    • Creative asset discovery

    Requirements

    • Collection must have text embeddings indexed
    • Collection must have image embeddings indexed

    Tags

    multimodal
    fusion
    text
    image

    Ready to use this template?

    Clone it into your namespace and start querying in minutes.