すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen-audio-3.1-asr-flash-streaming

最終更新日:Sep 29, 2026

Qwen-Audio-3.1-ASR-Flash-Streamingは、リアルタイム会議、ライブ字幕、インテリジェント対話などのシナリオ向けに設計されたエンドツーエンドのリアルタイム音声認識モデルです。ストリーミング音声書き起こしにおいて低遅延かつ高精度であることが特徴です。このモデルは、多言語および多地域の中国語方言認識、中国語と英語のシームレスな切り替え、ホットワードおよびコンテキスト強化、句読点予測、テキスト正規化をサポートしています。また、強力なノイズ耐性を備えており、複雑な音響環境にも適応できます。さらに、このバージョンでは多方言に対する制御可能なASR/AST出力もサポートされています。

推論サービスプロバイダー

qwen-audio-3.1-asr-flash-streamingの推論サービスプロバイダーはAlibaba Cloud Model Studioです。

モデル機能

機能サポート機能サポート
入力モダリティオーディオ出力モダリティテキスト
モデル体験未サポートFunction Calling未サポート
Structured Outputs未サポートWeb検索未サポート
Prefix Completion未サポートコンテキストキャッシュ未サポート
バッチ推論未サポートファインチューニング未サポート

コンテキスト制限

パラメータ値パラメータ値
最大入力長8192トークン最大出力長1024トークン
コンテキストウィンドウ8192トークン

料金

このページには、モデルAPI呼び出しの通常料金のみが表示されており、期間限定のプロモーションは含まれていません。プロモーション情報については、Model Studio Consoleをご覧ください。

中国(北京)

課金項目料金(USD)単位
入力0.848百万トークンあたり
出力0.636百万トークンあたり

Singapore

範囲:International

課金項目料金(USD)単位
入力0.93百万トークンあたり
出力0.70百万トークンあたり

レート制限

中国(北京)

パラメータ値
RPM(1分あたりのリクエスト数)600

Singapore

範囲:International

パラメータ値
RPM(1分あたりのリクエスト数)600

APIの使用