Qwen3.8-Flash は Qwen ファミリーの最新マルチモーダルモデルであり、強力な推論・生成能力と優れた応答速度を兼ね備えています。ネイティブで 100 万トークンのコンテキストウィンドウをサポートし、超長文ドキュメント、コードリポジトリ、複雑な会話を一度に処理できます。コーディング支援、エージェントワークフロー、画像・動画理解などのシナリオで特に優れたパフォーマンスを発揮します。OpenAI と Anthropic の両方の API プロトコルに完全対応し、Claude Code や Codex などの開発者ツールとシームレスに統合できます。優れた性能と競争力のある推論コストにより、Qwen3.8-Flash は AI アプリケーションで効果と効率の両立を目指す開発者や企業に最適な選択肢です。
モデルの機能
中国 (北京)
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | 画像 テキスト 動画 | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート済み |
構造化出力 | サポート済み | Web 検索 | サポート済み |
プレフィックス補完 | サポート済み | コンテキストキャッシュ | サポート済み |
バッチ推論 | 非サポート | ファインチューニング | 非サポート |
シンガポール
スコープ: 国際
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | 画像 テキスト 動画 | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート済み |
構造化出力 | サポート済み | Web 検索 | サポート済み |
プレフィックス補完 | サポート済み | コンテキストキャッシュ | サポート済み |
バッチ推論 | 非サポート | ファインチューニング | 非サポート |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 991808 | 最大出力長 | 131072 |
最大入力長 (思考モード) | 983616 | 最大出力長 (思考モード) | 131072 |
コンテキストウィンドウ | 1000000 | 最大思考連鎖長 | 262144 |
料金
このページでは、期間限定のプロモーションを除いた、モデル API 呼び出しの通常料金のみを記載しています。プロモーションオファーについては、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.14 | 100万トークンあたり |
出力 | 0.42 | 100万トークンあたり |
入力 (暗黙的キャッシュ) | 0.014 | 100万トークンあたり |
明示的キャッシュ作成 | 0.177 | 100万トークンあたり |
明示的キャッシュ読み取り | 0.014 | 100万トークンあたり |
シンガポール
スコープ: 国際
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.16 | 100万トークンあたり |
出力 | 0.47 | 100万トークンあたり |
入力 (暗黙的キャッシュ) | 0.016 | 100万トークンあたり |
明示的キャッシュ作成 | 0.200 | 100万トークンあたり |
明示的キャッシュ読み取り | 0.016 | 100万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 30,000 |
TPM (1分あたりのトークン数) | 5,000,000 |
シンガポール
スコープ: 国際
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 15,000 |
TPM (1分あたりのトークン数) | 2,000,000 |