すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen3.8-flash

最終更新日:Aug 28, 2026

Qwen3.8-Flash は Qwen ファミリーの最新マルチモーダルモデルであり、強力な推論・生成能力と優れた応答速度を兼ね備えています。ネイティブで 100 万トークンのコンテキストウィンドウをサポートし、超長文ドキュメント、コードリポジトリ、複雑な会話を一度に処理できます。コーディング支援、エージェントワークフロー、画像・動画理解などのシナリオで特に優れたパフォーマンスを発揮します。OpenAI と Anthropic の両方の API プロトコルに完全対応し、Claude Code や Codex などの開発者ツールとシームレスに統合できます。優れた性能と競争力のある推論コストにより、Qwen3.8-Flash は AI アプリケーションで効果と効率の両立を目指す開発者や企業に最適な選択肢です。

モデルの機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

画像 テキスト 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

非サポート

ファインチューニング

非サポート

シンガポール

スコープ: 国際

機能サポート機能サポート

入力モダリティ

画像 テキスト 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

非サポート

ファインチューニング

非サポート

コンテキスト制限

パラメーター値パラメーター値

最大入力長

991808

最大出力長

131072

最大入力長 (思考モード)

983616

最大出力長 (思考モード)

131072

コンテキストウィンドウ

1000000

最大思考連鎖長

262144

料金

このページでは、期間限定のプロモーションを除いた、モデル API 呼び出しの通常料金のみを記載しています。プロモーションオファーについては、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (USD)単位

入力

0.14

100万トークンあたり

出力

0.42

100万トークンあたり

入力 (暗黙的キャッシュ)

0.014

100万トークンあたり

明示的キャッシュ作成

0.177

100万トークンあたり

明示的キャッシュ読み取り

0.014

100万トークンあたり

シンガポール

スコープ: 国際

課金項目価格 (USD)単位

入力

0.16

100万トークンあたり

出力

0.47

100万トークンあたり

入力 (暗黙的キャッシュ)

0.016

100万トークンあたり

明示的キャッシュ作成

0.200

100万トークンあたり

明示的キャッシュ読み取り

0.016

100万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1分あたりのリクエスト数)

30,000

TPM (1分あたりのトークン数)

5,000,000

シンガポール

スコープ: 国際

パラメーター値

RPM (1分あたりのリクエスト数)

15,000

TPM (1分あたりのトークン数)

2,000,000