All Models
qwen2.5-vl-72b-instruct
Qwen2.5-VL is a powerful vision-language model with advanced capabilities in visual understanding, long video reasoning, and structured output generation.
Available Providers (9)
| Provider | Model ID | Input Cost | Output Cost | Context | Max Output | Docs |
|---|---|---|---|---|---|---|
| | qwen2.5-vl-72b-instruct | $0.25/MTok | $0.75/MTok | 32K | 32K | |
| | Qwen/Qwen2.5-VL-72B-Instruct | $0.25/MTok | $0.75/MTok | 128K | 8.2K | |
| | qwen2-5-vl-72b-instruct | $0.25/MTok | $0.75/MTok | 32K | 8.2K | |
| | qwen/qwen2.5-vl-72b-instruct | $0.80/MTok | $1/MTok | 128K | 128K | |
| | qwen/qwen2.5-vl-72b-instruct | $0.80/MTok | $0.80/MTok | 32.8K | 32.8K | |
| | qwen/qwen2.5-vl-72b-instruct | $0.80/MTok | $1/MTok | 128K | 128K | |
| | qwen2.5-vl-72b-instruct | $1.01/MTok | $1.01/MTok | 32.8K | 32.8K | |
| | qwen2-5-vl-72b-instruct | $2.29/MTok | $6.88/MTok | 131.1K | 8.2K | |
| | qwen2-5-vl-72b-instruct | $2.80/MTok | $8.40/MTok | 131.1K | 8.2K |
Capabilities
Reasoning
Tool Calling
Attachments
Open Weights
Structured Output