Input and output
Accepts Image, Text, Video inputs. Returns Text outputs.
Reka Edge is an extremely efficient 7B multimodal vision-language model that accepts image/video+text inputs and generates text outputs. This model is optimized specifically to deliver industry-leading performance in image understanding,...
Accepts Image, Text, Video inputs. Returns Text outputs.