ModelInfo
English
All models

Tongyi Embedding Vision Plus

Multimodal embedding model for cross-modal retrieval such as text-to-image, with 64-1152 dimensions.

Alibabatongyi-embedding-vision-plus2025-10-31Report incorrect data

Specs

Context
—
Max output
—
Input price
$0.09/ 1M tokens
Output price
—
Released
2025-10-31

Context

Context window
—
Max input
1K
Max output
—

Pricing · USD / 1M tokens

Input
$0.09
Output
—
Cache read
—
Cache write
—

Modalities

Input
TextImageVideo
Output
Embedding

API

API types
embeddings

Reasoning

Reasoning
No

Info

Status
Active
Released
2025-10-31
Knowledge cutoff
—

Features

Not published
Source · official docsVerified 2026-10-11

How to call

1 provider

alibabamodel = tongyi-embedding-vision-plus

JSON

Standard format
tongyi-embedding-vision-plus.json
{
  "id": "tongyi-embedding-vision-plus",
  "object": "model",
  "created": 1761868800,
  "owned_by": "alibaba",
  "name": "Tongyi Embedding Vision Plus",
  "api": {
    "types": [
      "embeddings"
    ]
  },
  "limits": {
    "context": null,
    "input": 1024,
    "output": null
  },
  "modalities": {
    "input": [
      "text",
      "image",
      "video"
    ],
    "output": [
      "embedding"
    ]
  },
  "reasoning": {
    "supported": false,
    "efforts": []
  },
  "pricing": {
    "currency": "USD",
    "unit": "1M_tokens",
    "input": 0.09,
    "output": null,
    "cache_read": null,
    "cache_write": null
  },
  "features": [],
  "info": {
    "status": "active",
    "release_date": "2025-10-31",
    "knowledge_cutoff": null,
    "description": "Multimodal embedding model for cross-modal retrieval such as text-to-image, with 64-1152 dimensions.",
    "docs": "https://www.alibabacloud.com/help/en/model-studio/embedding-rerank-model",
    "verified_at": "2026-10-11"
  }
}

Official sources

3