OpenAI

gpt-realtime-whisper

Generally availableProprietary

Summary

gpt-realtime-whisper is a proprietary language model from OpenAI, released on 7 May 2026. It accepts audio and generates text.

Streaming speech-to-text model for low-latency transcript deltas from live audio

Last verified 4 Oct 2026. Every figure on this page links to its source.

Specifications

DeveloperOpenAI
Release date7 May 2026 [models.dev]
StatusGenerally available [models.dev]
WeightsProprietary (API only) [models.dev]
InputAudio [models.dev]
OutputText [models.dev]
Reasoning modeNo [models.dev]
Tool callingNo [models.dev]

gpt-realtime-whisper API pricing by provider

USD per million tokens. Sorted by input price.

ProviderInputOutputCached inputContextSource
Vercel AI Gateway
openai/gpt-realtime-whisper
––––models.dev, 4 Oct 2026

Frequently asked questions

Is gpt-realtime-whisper open source?

No. gpt-realtime-whisper is a proprietary model; OpenAI has not released its weights. It is available through APIs including Vercel AI Gateway.

When was gpt-realtime-whisper released?

OpenAI released gpt-realtime-whisper on 7 May 2026, according to models.dev.

Change history

No changes detected since we started tracking this model. We re-check every source daily.

Sources