Qwen vision-language model for visual reasoning, documents, and agent tasks

Details

FieldValue
idqwen/qwen2.5-vl-72b-instruct
familyqwen
modalitytext+image->text
context_length128000
max_output_tokens115200
release_date2025-02-01
is_open_weightsno
supports_tool_callno
supports_reasoningno
supports_structured_outputyes
supports_attachmentyes
input_modalitiestext, image
output_modalitiestext
Qwen: Qwen2.5 VL 72B Instruct