# Qwen-Omni Turbo Realtime

> Qwen-Omni Turbo Realtime is a proprietary language model from Alibaba (Qwen), released on 8 May 2025. It accepts text, images and audio and generates text and audio, with a 33K-token context window and up to 2K output tokens per response. As of 4 Oct 2026, the lowest listed API price is $0.27 per million input tokens and $1.07 per million output tokens (Alibaba Cloud Model Studio), across 1 provider we track.

Source page: https://www.aimodel.directory/models/qwen-omni-turbo-realtime
Last verified: 4 Oct 2026

## Specifications

- **Developer:** Alibaba (Qwen)
- **Release date:** 8 May 2025 (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/alibaba/models/qwen-omni-turbo-realtime.toml)
- **Status:** Generally available (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/alibaba/models/qwen-omni-turbo-realtime.toml)
- **Weights:** Proprietary (API only) (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/alibaba/models/qwen-omni-turbo-realtime.toml)
- **Context window:** 33K (32,768 tokens) (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/alibaba/models/qwen-omni-turbo-realtime.toml)
- **Max output:** 2K tokens (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/alibaba/models/qwen-omni-turbo-realtime.toml)
- **Knowledge cutoff:** Apr 2024 (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/alibaba/models/qwen-omni-turbo-realtime.toml)
- **Input:** Text, images and audio (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/alibaba/models/qwen-omni-turbo-realtime.toml)
- **Output:** Text and audio (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/alibaba/models/qwen-omni-turbo-realtime.toml)
- **Reasoning mode:** No (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/alibaba/models/qwen-omni-turbo-realtime.toml)
- **Tool calling:** Yes (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/alibaba/models/qwen-omni-turbo-realtime.toml)

## API pricing (USD per 1M tokens)

| Provider | Input | Output | Cached input | Context |
|---|---|---|---|---|
| Alibaba Cloud Model Studio | $0.27 | $1.07 | – | 33K |

## FAQ

### What is the context window of Qwen-Omni Turbo Realtime?

Qwen-Omni Turbo Realtime has a context window of 32,768 tokens (33K) and can generate up to 2,048 tokens in a single response, according to models.dev.

### How much does the Qwen-Omni Turbo Realtime API cost?

Through Alibaba Cloud Model Studio, Qwen-Omni Turbo Realtime costs $0.27 per million input tokens and $1.07 per million output tokens. Prices last verified 4 Oct 2026.

### Is Qwen-Omni Turbo Realtime open source?

No. Qwen-Omni Turbo Realtime is a proprietary model; Alibaba (Qwen) has not released its weights. It is available through APIs including Alibaba Cloud Model Studio.

### When was Qwen-Omni Turbo Realtime released?

Alibaba (Qwen) released Qwen-Omni Turbo Realtime on 8 May 2025, according to models.dev.

---
Data licensed CC BY 4.0. Cite as: AI Model Directory, "Qwen-Omni Turbo Realtime", https://www.aimodel.directory/models/qwen-omni-turbo-realtime