GLM の新世代フラッグシップモデルで、コア機能は 4.5 と比較して全面的に向上しています。総パラメータ数は 3,550 億、アクティブパラメータ数は 320 億、コンテキストウィンドウは 200K に拡張されています。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート対象外 |
構造化出力 | サポート対象外 | Web 検索 | サポート対象外 |
プレフィックス補完 | サポート対象外 | コンテキストキャッシュ | サポート済み |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
コンテキスト制限
| パラメータ | 値 | パラメータ | 値 |
|---|---|---|---|
最大入力長 | 169984 | 最大出力長 | 16384 |
コンテキストウィンドウ | 202752 | 最大入力長 (思考モード) | 169984 |
最大出力長 (思考モード) | 16384 | 最大思考連鎖長 | 32768 |
料金
このページでは、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみを記載しています。プロモーション情報については、Model Studio コンソールをご参照ください。
中国 (北京)
32k<入力<=200k
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.574 | 100万トークンあたり |
出力 | 2.294 | 100万トークンあたり |
入力 (暗黙的キャッシュ) | 0.115 | 100万トークンあたり |
レート制限
中国 (北京)
| パラメータ | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 60 |
TPM (1分あたりのトークン数) | 1,000,000 |