Speech generation model for controllable voice, narration, and audio delivery

Details

FieldValue
idopenai/gpt-audio
familygpt
modalitytext+audio+pdf->text+audio
context_length128000
max_output_tokens16384
release_date2026-01-19
is_open_weightsno
supports_tool_callyes
supports_reasoningno
supports_structured_outputyes
supports_attachmentyes
input_modalitiestext, audio, pdf
output_modalitiestext, audio

Providers