Input and output
Accepts Text, Image inputs. Returns Text outputs.
Qwen2.5-VL is proficient in recognizing common objects such as flowers, birds, fish, and insects. It is also highly capable of analyzing texts, charts, icons, graphics, and layouts within images.
Accepts Text, Image inputs. Returns Text outputs.