Qwen omni model for text, vision, audio, and multimodal agent tasks

Details

FieldValue
idqwen-omni-turbo
familyqwen
modalitytext+image+audio+video->text+audio
context_length32768
max_output_tokens2048
knowledge_cutoff2024-04
release_date2025-01-19
is_open_weightsno
supports_tool_callyes
supports_reasoningno
supports_structured_outputno
supports_attachmentno
input_modalitiestext, image, audio, video
output_modalitiestext, audio

Providers

Qwen-Omni Turbo