Qwen omni model for text, vision, audio, and multimodal agent tasks

Details

FieldValue
idqwen/qwen3-omni-30b-a3b-instruct
familyqwen
modalitytext+video+audio+image->text+audio
context_length65536
max_output_tokens16384
knowledge_cutoff2024-04
release_date2025-09-24
is_open_weightsyes
supports_tool_callyes
supports_reasoningno
supports_structured_outputyes
supports_attachmentyes
input_modalitiestext, video, audio, image
output_modalitiestext, audio

Providers