QwenReasoningReasoningActive

Qwen: Qwen3 VL 8B Instruct

Qwen3-VL-8B-Instruct is a multimodal vision-language model from the Qwen3-VL series, built for high-fidelity understanding and reasoning across text, images, and video. It features improved multimodal fusion with Interleaved-MRoPE for long-horizon...

Specification
Model ID
qwen/qwen3-vl-8b-instruct
Modality
Text+image >text
Context
262.1K tokens
Input
$0.117/1M
Output
$0.455/1M
Updated
Sep 20, 2026
Scores
Capabilities
  • Supports tool calling
  • Supports vision inputs
  • Supports long-context workflows
  • Lighter reasoning profile