すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen-audio-3.1-asr-flash

最終更新日:Sep 23, 2026

Qwen-Audio-3.1-ASR-Flashは、高品質で多言語・多文化なコンテンツの文字起こしシナリオ向けに設計された、効率的な短時間音声認識をサポートする大規模モデルです。このモデルは、多言語および中国各地の方言認識に対応しており、中国古典詩のリズム、韻律、文言表現に最適化されています。コンテキスト強化、句読点予測、テキスト正規化機能を備えています。また、このバージョンでは複数の方言に対する制御可能なASR/AST出力もサポートしています。ネイティブな文字起こしと推敲機能に加え、産業グレードの複数話者ダイアログにおける話者識別付き文字起こし機能も搭載しています。

推論サービスプロバイダー

qwen-audio-3.1-asr-flashの推論サービスプロバイダーはAlibaba Cloud Model Studioです。

モデル機能

機能サポート機能サポート
入力モダリティオーディオ出力モダリティテキスト
モデル体験未サポートFunction Calling未サポート
Structured Outputs未サポートWeb検索未サポート
Prefix Completion未サポートコンテキストキャッシュ未サポート
バッチ推論未サポートファインチューニング未サポート

コンテキスト制限

パラメータ値パラメータ値
最大入力長7168トークン最大出力長1024トークン
コンテキストウィンドウ8192トークン

料金

このページには、モデルAPI呼び出しの通常料金のみが表示されており、期間限定のプロモーションは含まれていません。プロモーション情報については、Model Studio Consoleをご覧ください。

中国(北京)

課金項目料金(USD)単位
入力0.113百万トークンあたり
出力0.382百万トークンあたり

Singapore

範囲:International

課金項目料金(USD)単位
入力0.15百万トークンあたり
出力0.47百万トークンあたり

レート制限

中国(北京)

パラメータ値
RPM(1分あたりのリクエスト数)600

Singapore

範囲:International

パラメータ値
RPM(1分あたりのリクエスト数)600

APIの使用