Input and output
Accepts Text, Image, Video, File, Audio inputs. Returns Text outputs.
Muse Spark 1.1 is a multimodal reasoning model from Meta, built for agentic tasks. It accepts text, images, video, audio, and PDF documents and returns text, with a 1M-token context...
Accepts Text, Image, Video, File, Audio inputs. Returns Text outputs.