Qwen シリーズの大規模言語モデルである Qwen-MT-Flash は、Qwen 3 アーキテクチャで完全にアップグレードされ、パフォーマンスと翻訳品質が大幅に向上しました。用語介入、フォーマット維持、特定ドメインへの適応などの高度な機能をサポートしながら、92 の言語にわたって迅速でコスト効率の高い翻訳を提供します。速度、品質、コストの強力なバランスを必要とするアプリケーションにとって理想的な選択肢です。
推論サービスプロバイダー
qwen-mt-flash の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | テキスト |
モデル体験 | 対応 | 関数呼び出し | 非対応 |
構造化出力 | 非対応 | Web 検索 | 非対応 |
プレフィックス補完 | 非対応 | コンテキストキャッシュ | 非対応 |
バッチ推論 | 非対応 | ファインチューニング | 非対応 |
コンテキスト長の制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 8192 | 最大出力長 | 8192 |
コンテキストウィンドウ | 16384 |
料金
このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーション情報については、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.101 | 100 万トークンあたり |
出力 | 0.28 | 100 万トークンあたり |
シンガポール
スコープ: 国際
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.16 | 100 万トークンあたり |
出力 | 0.49 | 100 万トークンあたり |
ドイツ (フランクフルト)
スコープ: グローバル
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.101 | 100 万トークンあたり |
出力 | 0.28 | 100 万トークンあたり |
米国 (バージニア)
スコープ: グローバル
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.101 | 100 万トークンあたり |
出力 | 0.28 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 60 |
TPM (1 分あたりのトークン数) | 35,000 |
シンガポール
スコープ: 国際
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 60 |
TPM (1 分あたりのトークン数) | 100,000 |
ドイツ (フランクフルト)
スコープ: グローバル
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 60 |
TPM (1 分あたりのトークン数) | 35,000 |
米国 (バージニア)
スコープ: グローバル
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 60 |
TPM (1 分あたりのトークン数) | 100,000 |