All Products
Search
Document Center

Alibaba Cloud Model Studio:multimodal-embedding-v1

Last Updated:Sep 28, 2026

Multimodal vector model developed by Tongyi Lab based on pre-trained multimodal foundation models. Generates high-dimensional continuous vectors from text, image, or video inputs for downstream tasks including search, classification, and content moderation.

Inference Service Provider

The inference service provider for multimodal-embedding-v1 is Alibaba Cloud Model Studio.

Model Capabilities

CapabilitySupportCapabilitySupport

Input Modality

Text Image Video

Output Modality

—

Model Experience

Unsupported

Function Calling

Unsupported

Structured Outputs

Unsupported

Web Search

Unsupported

Prefix Completion

Unsupported

Context Caching

Unsupported

Batch Inference

Unsupported

Fine-tuning

Unsupported

Context Limits

ParameterValueParameterValue

Max Input Length

512

Max Output Length

0

Context Window

0

Rate Limits

China (Beijing)

ParameterValue

RPM (Requests Per Minute)

120

TPM (Tokens Per Minute)

1,000,000