Models/gpt-audio-2025-08-28

gpt-audio-2025-08-28Active · Cloud

Azure · Released Jan 2026 · Proprietary

The gpt-audio model is OpenAI's first generally available audio model. The new snapshot features an upgraded decoder for more natural sounding voices and maintains better voice consistency. Audio is priced...

Context
128K
Max output
16K
Input
$2.50
Output
$10.00
Cached in
-
Latency
-

Capabilities

Core
Streaming
Function calling
JSON mode
Structured outputs
Multimodal
Vision
Image input
Audio
Image generation
Video
Advanced
Reasoning
Tool calling
MCP
Prompt caching
Batch API
Embeddings

Details

ProviderAzure
ReleasedJan 2026
LicenseProprietary
InputAudio, Text
OutputAudio, Text
Throughput-
Availability100%

Related models