Input and output
Accepts Text, Image, Video inputs. Returns Text outputs.
Qwen3.5-9B is a multimodal foundation model from the Qwen3.5 family, designed to deliver strong reasoning, coding, and visual understanding in an efficient 9B-parameter architecture. It uses a unified vision-language design...
Accepts Text, Image, Video inputs. Returns Text outputs.