全部产品
Search
文档中心

大模型服务平台百炼:qwen-audio-3.0-realtime-flash

更新时间:Sep 21, 2026

千问实时语音对话大模型3.0 是一款登顶全球权威评测的下一代实时双工语音大模型,它在全球权威第三方评测平台 Artificial Analysis Speech-to-Speech子项中取得综合排名第一。千问实时语音对话大模型3.0兼顾了模型智商与双工对话节奏,在保持流畅、自然的实时交互体验的同时,语音推理能力不打折扣;并通过并行推理和全向流式等工程优化,将端到端响应时延控制在低水平,实现"又快又聪明"的对话体验。极速版更注重极致的响应速度

推理服务供应商

qwen-audio-3.0-realtime-flash模型的推理服务供应商为阿里云百炼。

模型能力

能力项支持情况能力项支持情况

输入模态

Audio Text

输出模态

Audio Text

模型体验

不支持

Function Calling

支持

结构化输出

不支持

联网搜索

支持

前缀续写

不支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数参数

最大输入长度

16384

最大输出长度

8192

上下文长度

40960

最大输入长度(思考模式下)

16384

最大输出长度(思考模式下)

8192

最大思维链长度

1024

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

计费项价格(美元)单位

输入:音频

0.848

每百万tokens

输入:文本

0.212

每百万tokens

输出:文本

0.636

每百万tokens

输出:文本+音频(输出的文本不计费)

1.696

每百万tokens

新加坡

部署范围:国际

计费项价格(美元)单位

输入:音频

0.93

每百万tokens

输入:文本

0.23

每百万tokens

输出:文本

0.7

每百万tokens

输出:文本+音频(输出的文本不计费)

1.87

每百万tokens

限流

华北2(北京)

参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

100,000

新加坡

部署范围:国际

参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

100,000