音声・動画の理解とコンテンツ分析のためのモデルです。テキスト、画像、音声、動画の入力とテキストの出力に対応しています。
推論サービスプロバイダー
qwen3.8-omni-flash の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
対応リージョン:中国(北京)、シンガポール、中国(香港)、日本(東京)、ドイツ(フランクフルト)、米国(バージニア)。選択したリージョンの API キーを使用してください。
| 機能 | 対応状況 | 機能 | 対応状況 |
|---|---|---|---|
| 入力モダリティ | テキスト、画像、音声、動画 | 出力モダリティ | テキスト |
| Function Calling | カスタムツールの呼び出しに対応 | 思考 | デフォルトで有効です。推論の強度を調整できます。思考を参照してください |
| Web 検索 | Web 検索に対応。Responses の組み込みツールは web_search です | コンテキストキャッシュ | 自動的な暗黙的キャッシュと Responses Session キャッシュに対応 |
| 音声入力の言語 | Qwen3.5-Omni と同じ 113 の言語・方言に対応。全一覧はモデルの選択を参照してください | マルチチャンネル音声 | 空間音声入力に対応。Chat Completions で use_multichannel を使用して有効にします |
Chat Completions または Responses を使用します。例については、非リアルタイム利用ガイドを参照してください。
コンテキストの上限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
| コンテキストウィンドウ | 1M tokens | 最大入力長(非思考モード) | 991808 tokens |
| 最大入力長(思考モード) | 983616 tokens | 最大出力長 | 131072 tokens |
モデル料金
推論料金については、モデル料金を参照してください。
レート制限
モデルのリクエスト制限については、レート制限を参照してください。