gpt-realtime-whisper
Generally availableProprietary
Summary
gpt-realtime-whisper is a proprietary language model from OpenAI, released on 7 May 2026. It accepts audio and generates text.
Streaming speech-to-text model for low-latency transcript deltas from live audio
Last verified 4 Oct 2026. Every figure on this page links to its source.
Specifications
| Developer | OpenAI |
|---|---|
| Release date | 7 May 2026 [models.dev] |
| Status | Generally available [models.dev] |
| Weights | Proprietary (API only) [models.dev] |
| Input | Audio [models.dev] |
| Output | Text [models.dev] |
| Reasoning mode | No [models.dev] |
| Tool calling | No [models.dev] |
gpt-realtime-whisper API pricing by provider
USD per million tokens. Sorted by input price.
| Provider | Input | Output | Cached input | Context | Source |
|---|---|---|---|---|---|
| Vercel AI Gateway openai/gpt-realtime-whisper | – | – | – | – | models.dev, 4 Oct 2026 |
Frequently asked questions
Is gpt-realtime-whisper open source?
No. gpt-realtime-whisper is a proprietary model; OpenAI has not released its weights. It is available through APIs including Vercel AI Gateway.
When was gpt-realtime-whisper released?
OpenAI released gpt-realtime-whisper on 7 May 2026, according to models.dev.
Change history
No changes detected since we started tracking this model. We re-check every source daily.