ModelInfo
English
All models

Llama Nemotron Embed VL 1B v2

Multimodal question-answer retrieval model representing user queries as text and documents as images.

NVIDIAllama-nemotron-embed-vl-1b-v22026-02-10Report incorrect data

Specs

Context
—
Max output
—
Input price
—
Output price
—
Released
2026-02-10

Context

Not published

Pricing

Not published

Modalities

Input
TextImage
Output
Embedding

API

API types
embeddings

Reasoning

Not published

Info

Status
Active
Released
2026-02-10
Knowledge cutoff
—

Features

Not published
Source · official docsVerified 2026-10-11

How to call

1 provider

nvidiamodel = nvidia/llama-nemotron-embed-vl-1b-v2

embeddings
POSThttps://integrate.api.nvidia.com/v1/embeddings

JSON

Standard format
llama-nemotron-embed-vl-1b-v2.json
{
  "id": "llama-nemotron-embed-vl-1b-v2",
  "object": "model",
  "created": 1770681600,
  "owned_by": "nvidia",
  "name": "Llama Nemotron Embed VL 1B v2",
  "api": {
    "types": [
      "embeddings"
    ]
  },
  "limits": {
    "context": null,
    "input": null,
    "output": null
  },
  "modalities": {
    "input": [
      "text",
      "image"
    ],
    "output": [
      "embedding"
    ]
  },
  "reasoning": {
    "supported": null,
    "efforts": []
  },
  "pricing": null,
  "features": [],
  "info": {
    "status": "active",
    "release_date": "2026-02-10",
    "knowledge_cutoff": null,
    "description": "Multimodal question-answer retrieval model representing user queries as text and documents as images.",
    "docs": "https://build.nvidia.com/nvidia/llama-nemotron-embed-vl-1b-v2/modelcard",
    "verified_at": "2026-10-11"
  }
}

Official sources

2