All Models

Llama-3.2-90B-Vision-Instruct

llama Tool Calling Attachments Open Weights

Open Llama multimodal model for image understanding and text reasoning

Providers 2
Released Sep 25, 2024
Input Modalities text, image
Output Modalities text
Tarsk Use coding

Available Providers (2)

Provider Model ID Input Cost Output Cost Context Max Output Docs
Nvidia meta/llama-3.2-90b-vision-instruct $0/MTok $0/MTok 128K 8.2K
IO.NET meta-llama/Llama-3.2-90B-Vision-Instruct $0.35/MTok $0.40/MTok 16K 4.1K

Capabilities

Reasoning
Tool Calling
Attachments
Open Weights
Structured Output