すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen-turbo

最終更新日:Aug 26, 2026

Qwen3 シリーズの Turbo モデルです。思考モードとノンシンキングモードを効果的に統合し、対話中のモード切り替えを可能にします。その推論能力は、より小さいパラメーターサイズで QwQ-32B に匹敵し、汎用能力は Qwen2.5-Turbo を大幅に上回り、同規模のモデルの中で業界最高水準を達成しています。このモデルバージョンは、スナップショットモデル qwen-turbo-2025-04-28 と機能的に同等です。

推論サービスプロバイダー

qwen-turbo の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

Function Calling

非サポート

構造化出力

サポート

Web 検索

非サポート

プレフィックス補完

非サポート

コンテキストキャッシュ

サポート

バッチ推論

非サポート

ファインチューニング

非サポート

シンガポール

範囲:国際

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

Function Calling

非サポート

構造化出力

サポート

Web 検索

非サポート

プレフィックス補完

サポート

コンテキストキャッシュ

サポート

バッチ推論

サポート

ファインチューニング

非サポート

コンテキスト長の制限

パラメーター値パラメーター値

最大入力長

98304

最大出力長

16384

コンテキストウィンドウ

131072

料金

このページには、期間限定プロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーション情報については、Model Studio コンソールでご確認ください。

中国 (北京)

課金項目料金 (米ドル)単位

入力

0.044

100 万トークンあたり

出力

0.087

100 万トークンあたり

入力 (思考)

0.044

100 万トークンあたり

出力 (思考)

0.431

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.009

100 万トークンあたり

入力 (思考、暗黙的キャッシュ)

0.009

100 万トークンあたり

シンガポール

範囲:国際

課金項目料金 (米ドル)単位

入力

0.05

100 万トークンあたり

出力

0.2

100 万トークンあたり

入力 (思考)

0.05

100 万トークンあたり

出力 (思考)

0.5

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.01

100 万トークンあたり

入力 (思考、暗黙的キャッシュ)

0.01

100 万トークンあたり

思考出力 (バッチファイル)

0.25

100 万トークンあたり

入力 (バッチファイル)

0.025

100 万トークンあたり

出力 (バッチファイル)

0.1

100 万トークンあたり

入力 (思考、バッチファイル)

0.025

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

1200

TPM (1 分あたりのトークン数)

5,000,000

シンガポール

範囲:国際

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

5,000,000