Qwen omni model for text, vision, audio, and multimodal agent tasks

Details

FieldValue
idqwen3-8-omni-flash
familyqwen
modalitytext+image+audio+video->text
context_length1000000
max_output_tokens131072
release_date2026-09-17
is_open_weightsno
supports_tool_callyes
supports_reasoningyes
supports_structured_outputyes
supports_attachmentyes
input_modalitiestext, image, audio, video
output_modalitiestext