Post-Cutoff.com
  1. Home
  2. Models
  3. Qwen-Audio-3.1-Realtime (Plus)

Qwen-Audio-3.1-Realtime (Plus)

Alibaba (Qwen)currentaudio/speechQwen-Audio 3.1

Languages: de, en, es, fr, id, it, ja, ko, pt, ru, zh (Mandarin, Cantonese and 18+ Chinese varieties). Predecessors qwen-audio-3.0-realtime-plus / -flash (July 2026) still listed. Press (MarkTechPost) reports interruption-stop latency 1.116 s vs 0.383 s for GPT-Realtime-2 and higher red-team refusal for GPT-Realtime-2; not verified on an official page. Release date is the announcement date (Qwen X post / Apsara); Model Studio pricing for this id not verified.

Context window
262,144 tokens
Max output
16,384 tokens
Input
audio, text
Output
audio, text
License
proprietary
Pricing
audio input: $6.4 · text input: $0.8 · text output: $6.4 · audio output: $24 (USD per 1M tokens (QwenCloud list price; audio/text output $24 when audio is generated, $6.40 text-only)) source
Verified
2026-09-29

How to call it

ProviderModel idEndpoint / URLDocs
QwenCloud (Realtime WebSocket)qwen-audio-3.1-realtime-pluswss://maas.qwencloudapi.com/api-ws/v1/realtime?model=qwen-audio-3.1-realtime-plusdocs
Alibaba Cloud Model Studio (Singapore / Beijing)qwen-audio-3.1-realtime-pluswss://{WorkspaceId}.sg-singapore.maas.aliyuncs.com/api-ws/v1/realtimedocs

Notable capabilities (3)

Alibaba's hosted real-time voice agent model (WebSocket Realtime API, OpenAI-Realtime-style events).

Sources: https://www.qwencloud.com/models/qwen-audio-3.1-realtime-plus · https://help.aliyun.com/en/model-studio/qwen-audio-realtime-user-guides · https://arxiv.org/abs/2609.25176

Timeline entry

  1. Alibaba launches Qwen-Audio-3.1 five-model voice stack and cuts audio API prices up to 95% ★★★

    Around its 2026 Apsara Conference Alibaba's Qwen team released Qwen-Audio-3.1: upgraded ASR, TTS and full-duplex Realtime models plus two new ones (ASR-Next for audio understanding, TTS-Next for one-pass speech+SFX+ambience generation), with price cuts of ~70% (TTS), ~85% (Realtime) and up to 95%…

Other Alibaba (Qwen) models

Qwen-Audio-3.1-ASR (Flash) · Qwen-Audio-3.1-TTS-Next · Qwen3.8-LiveTranslate (Flash Realtime) · Qwen3.8-Omni-Flash · Qwen3.8-27B · Qwen3.8-Flash · Qwen3.8-Max · Qwen-Image-3.0 (Pro) · Qwen3.7-Plus · Qwen3-ASR (0.6B / 1.7B) + Qwen3-ForcedAligner · Qwen3-TTS (open weights 0.6B / 1.7B; API qwen3-tts-flash)