Multimodal Search
Multimodal Search with Fusion
Combines text and image embeddings using RRF fusion for comprehensive multimodal search.
No credit card to start · Build from $25/mo
Pipeline Stages
1
multimodal_search
filter
feature_searchView parameters
{
"searches": [
{
"feature_uri": "mixpeek://text_extractor@v1/multilingual_e5_large_instruct_v1",
"query": {
"input_mode": "text",
"value": "{{INPUT.query}}"
},
"top_k": 100
},
{
"feature_uri": "mixpeek://image_extractor@v1/google_siglip_base_v1",
"query": {
"input_mode": "text",
"value": "{{INPUT.query}}"
},
"top_k": 50
}
],
"final_top_k": 25,
"fusion": "rrf"
}Input Schema
querytext
required
Multimodal search query
e.g. sunset over mountains
Use Cases
- E-commerce visual search
- Media library search
- Creative asset discovery
Requirements
- Collection must have text embeddings indexed
- Collection must have image embeddings indexed
Tags
multimodal
fusion
text
image
Ready to use this template?
Clone it into your namespace and start querying in minutes.