すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen-audio-3.1-asr-flash-filetrans

最終更新日:Sep 23, 2026

Qwen-Audio-3.1-ASR-Flash-Filetransは、会議の書き起こし、コンテンツ制作、通話分析などのシナリオ向けに設計されたエンドツーエンドのオフライン音声認識モデルです。多言語および多地域の中国語方言認識をサポートしています。高精度の書き起こし、ホットワードおよびコンテキスト強化、話者分離、句読点予測、テキスト正規化機能を備えています。複雑なノイズ環境でも安定したパフォーマンスを維持し、長時間のオーディオ書き起こしの首选となります。このバージョンでは、多方言に対する制御可能なASR/AST出力もサポートされています。

推論サービスプロバイダー

qwen-audio-3.1-asr-flash-filetransの推論サービスプロバイダーはAlibaba Cloud Model Studioです。

モデル機能

機能サポート機能サポート
入力モダリティオーディオ出力モダリティテキスト
モデル体験未サポートFunction Calling未サポート
Structured Outputs未サポートWeb検索未サポート
Prefix Completion未サポートコンテキストキャッシュ未サポート
バッチ推論未サポートファインチューニング未サポート

コンテキスト制限

パラメータ値パラメータ値
最大入力長8192トークン最大出力長1024トークン
コンテキストウィンドウ8192トークン

料金

このページには、モデルAPI呼び出しの通常料金のみが表示されており、期間限定のプロモーションは含まれていません。プロモーション情報については、Model Studio Consoleをご覧ください。

中国(北京)

課金項目料金(USD)単位
入力0.113百万トークンあたり
出力0.382百万トークンあたり

Singapore

範囲:International

課金項目料金(USD)単位
入力0.15百万トークンあたり
出力0.47百万トークンあたり

レート制限

中国(北京)

パラメータ値
RPM(1分あたりのリクエスト数)600

Singapore

範囲:International

パラメータ値
RPM(1分あたりのリクエスト数)600

APIの使用