Alibaba Cloud Model Studio は、ワンストップのモデルサービスプラットフォームです。公式の Qwen API と OpenAI 互換 API を通じて、Qwen シリーズの全モデルと主要なサードパーティ LLM を提供し、テキスト、画像、音声/動画にわたるマルチモーダルをサポートします。インフラストラクチャの管理は不要で、オンデマンドでモデルを呼び出すことができます。
数行のコードでコンテンツや要約を生成します。
Model Studio は OpenAI と互換性があります。API キー、ベース URL、モデル名を更新するだけで、既存の OpenAI コードを移行できます。
import os
from openai import OpenAI
# 注:base_url はリージョンによって異なります。次の例では、シンガポールリージョンの base_url を使用しています。
# - シンガポール:https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1。{WorkspaceId} をお使いのワークスペース ID に置き換えてください。
# - 中国 (北京):https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
# - 中国 (香港):https://{WorkspaceId}.cn-hongkong.maas.aliyuncs.com/compatible-mode/v1
# - 日本 (東京):https://{WorkspaceId}.ap-northeast-1.maas.aliyuncs.com/compatible-mode/v1
# - ドイツ (フランクフルト):https://{WorkspaceId}.eu-central-1.maas.aliyuncs.com/compatible-mode/v1
# - 米国 (バージニア):https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/compatible-mode/v1
client = OpenAI(
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1" # {WorkspaceId} をお使いのワークスペース ID に置き換えてください
)
completion = client.chat.completions.create(
model="qwen-max",
messages=[{"role": "user", "content": "Who are you?"}]
)
print(completion.choices[0].message.content)
モデルサービス
Model Studio は、独自の Qwen シリーズや、DeepSeek、Kimi、GLM などのサードパーティモデルを含む、すぐに使えるモデルサービスを提供します。詳細については、「推奨モデル」をご参照ください。
-
Qwen フラッグシップモデル:
-
Qwen-Max:Qwen シリーズで最も高性能なモデルで、複雑なマルチステップのタスクに適しています。
最新の qwen-max は、前世代のモデルに比べて推論能力が大幅に向上しています。推奨します。
-
Qwen-Plus:パフォーマンス、速度、コストのバランスが取れており、ほとんどのシナリオで推奨します。
-
Qwen-Flash:低コストかつ低遅延で、迅速な応答が求められる単純なタスクに適しています。
-
-
マルチモーダル対応:テキスト生成、視覚理解、画像生成、動画生成、音声認識と音声合成、埋め込みなどが含まれます。
-
ドメイン固有モデル:長文処理、翻訳、データマイニング、意図認識、ロールプレイング、詳細な調査などのためのモデル。
課金
Model Studio の有効化は無料です。コストは、モデルのを行った場合にのみ発生します。詳細については、「課金対象と料金」をご参照ください。
- モデル推論 — deepseek-v2 のような大規模言語モデルは、生成されたトークン数に基づいて課金されます。Savings Plans を使用してコストを相殺できます。
- ナレッジベース (RAG) — ナレッジベースは独立した検索拡張生成機能で、仕様期間とモデルの呼び出しに応じて課金されます。Savings Plans やリソースプランはサポートしていません。
注記モデル推論とナレッジベースは、Model Studio 内の個別の機能であり、それぞれ独立して課金されます。
新規ユーザー向けの無料クォータ
新規ユーザーは、シンガポールリージョン でモデル呼び出しを試すための無料クォータを受け取ります。
- プロファイルが未完了のユーザーは、無料クォータを使い切った後、サービスを継続して使用することはできません。従量課金に切り替えるには、プロファイルを完了する必要があります。
- プロファイルが完了しているユーザーは、無料クォータを使い切ると自動的に従量課金に切り替わります。予期しない請求を避けるには、無料クォータのみ 機能を有効にしてください。この機能を有効にすると、クォータが使い果たされた時点でサービスが停止します。
詳細については、「新規ユーザー向けの無料クォータ」をご参照ください。
支払い方法
モデル呼び出しは分単位で課金されます。サポートされている支払い方法については、「支払い方法」をご参照ください。
請求と使用状況の表示
- 請求明細:請求明細 ページとコスト分析ページに移動します。
- 呼び出し統計:モデル呼び出しを行ってから約 1 時間後、Model Studio コンソールに移動し、右上の隅でリージョンを選択し、監視 ページに移動し、クエリ条件を設定します。対象モデルの Actions 列にある 監視 をクリックすると、呼び出し量、トークン消費量、成功率などの統計情報が表示されます。詳細については、「モデルモニタリング」をご参照ください。
- Coding Plan の使用状況:Coding Plan を契約している場合、Coding Plan ページ でクォータの消費量を確認できます。Coding Plan は、AI コーディングツール向けの月間リクエストクォータが設けられた固定月額料金プランです。詳細については、「Coding Plan の概要」をご参照ください。
はじめに
-
オンラインでモデルを試す:
- Model Studio コンソールを開き、右上の隅でリージョンを選択します。
- プレイグラウンドに移動し、モデルを選択します。
-
最初の API 呼び出しを行う:Qwen API への最初の呼び出し
よくある質問
Q:私のデータは安全ですか?Alibaba Cloud Model Studio は私のデータをトレーニングに使用しますか?
A:Alibaba Cloud はデータのプライバシーを保護し、お客様のデータをモデルのトレーニングに使用することはありません。アプリケーションの構築やモデルのトレーニング時に送信されるすべてのデータは暗号化されます。詳細については、「セキュリティ認証とプライバシー」をご参照ください。
Q:Model Studio はいくつのリージョンで利用できますか?リージョン間の違いは何ですか?
A:Model Studio は、以下のリージョンで利用できます。
中国 (北京)、米国 (バージニア)、シンガポール、日本 (東京)、ドイツ (フランクフルト)、中国 (香港)
ネットワーク遅延を低減するために、近くのリージョンを選択してください。リージョンによって、エンドポイントとベース URL、API キー (リージョン間で互換性なし)、サポートされているモデル、プラットフォームの機能、料金が異なります。詳細については、「モデルリスト」をご参照ください。
Q:自動請求を回避するにはどうすればよいですか?
A:Model Studio は 自動引き落とし のない従量課金制です。課金を回避するには、次の手順を実行します。
- API キーの削除:Model Studio コンソールに移動し、リージョンを選択し、API キーページに移動して、すべての API キーを削除します。
- すべてのモデル呼び出しの停止:アプリケーション、エージェント、ワークフロー内のすべてのモデル呼び出し (スケジュールされたタスクやバックグラウンドプロセスを含む) を停止します。
- 無料クォータのみをオンにする (新規ユーザーのみ):モデル詳細ページで、このスイッチを有効にします。クォータが使い果たされるとサービスが停止し、有料での利用を防ぎます。有効期間内に、シンガポールリージョンのモデルにのみ適用されます。
- コスト監視とアラートの設定: 請求明細と監視を表示し、高額利用アラートを設定して異常な支出を検出します。
- Coding Plan:このプランは、月間リクエストクォータが設定された固定月額料金のプランで、従量課金の代わりとなります。呼び出しを行う際は、Coding Plan 専用のベース URL と API キーを使用してください。そうしないと、モデル呼び出しは従量課金で請求されます。詳細については、「Coding Plan の概要」をご参照ください。
Q:Qwen や DeepSeek を使用するにはどうすればよいですか?
A:
- オンラインで試す:Model Studio コンソールを開き、リージョンを選択し、モデルページに移動して、モデルをクリックします。(DeepSeek は中国 (北京) リージョンでのみ利用可能です。)
- API 経由でモデルを呼び出す:詳細については、「Qwen API への最初の呼び出し」をご参照ください。
- 開発者ツールを使用する:詳細については、「クライアントまたは開発者ツールへの接続」をご参照ください。