Alibaba Cloud Model Studio est disponible dans plusieurs régions. Chaque région propose différents types de domaines d'accès, notamment des domaines dédiés à l'espace de travail et des domaines DashScope, et prend en charge plusieurs portées de déploiement de service pour répondre à diverses exigences d'accès.
Présentation des régions
Les régions déterminent le point d'accès et l'emplacement de stockage des données. Choisissez une région proche afin de réduire la latence.
- Portée de déploiement du service : détermine l'emplacement d'exécution de l'inférence. Si vous avez des exigences de conformité des données, sélectionnez une portée avec des limites géographiques spécifiques. Sinon, choisissez la portée mondiale (Global) pour bénéficier d'un pool de ressources d'inférence plus vaste.
- Domaine d'accès : affecte les limites de concurrence, les délais d'expiration et autres garanties de service. Chaque région dispose de son propre domaine d'accès dédié.
Le flux complet d'appel de modèle se déroule comme suit :
- Votre application envoie une requête à la région sélectionnée via le domaine d'accès. Les données de la requête sont stockées dans cette région.
- La région transfère la requête aux nœuds d'inférence situés dans la portée de déploiement du service pour le calcul (toutes les transmissions sont chiffrées).
- Le résultat de l'inférence est renvoyé à la région pour stockage, puis transmis à votre application. Vos données statiques restent toujours dans la région sélectionnée.
Sélectionner une région et une portée de déploiement du service
Différentes régions prennent en charge différentes portées de déploiement de service, et Model Studio planifie l'inférence au sein de la portée sélectionnée. Par exemple, la région US (Virginie) prend en charge les portées Global et US, tandis que l'Allemagne (Francfort) prend en charge Global et EU. Pour obtenir la liste complète des régions et des portées de déploiement de service prises en charge, accédez à la console.
Domaine d'accès
Model Studio propose trois types de domaines d'accès pour les API d'inférence de modèles : dédié à l'espace de travail, DashScope et d'essai, couvrant des scénarios allant de l'exploration initiale à la production de niveau entreprise. Nous vous recommandons d'utiliser le domaine dédié à l'espace de travail. Voici les principales différences :
| Comparaison | Domaine dédié à l'espace de travail (recommandé) | Domaine DashScope (domaine existant) | Domaine d'essai |
|---|---|---|---|
| Format du domaine |
|
|
|
| Cas d'utilisation | Recommandé pour les environnements de production. Offre une capacité de concurrence plus élevée et un isolement réseau, garantissant un accès stable et à faible latence même sous forte charge. | Pour les intégrations existantes. Nous vous recommandons de migrer vers le domaine dédié à l'espace de travail. | Essai rapide et validation des fonctionnalités. Non recommandé pour les environnements de production. |
| Portée de l'authentification | Accès à l'espace de travail actuel uniquement | Accès à tous les espaces de travail | Accès à tous les espaces de travail |
| Limites de débit | Les RPM et TPM varient selon le modèle et sont agrégés au niveau du compte Alibaba Cloud | Les RPM et TPM varient selon le modèle et sont agrégés au niveau du compte Alibaba Cloud | Le RPM est de 1 000 (au niveau du compte Alibaba Cloud) ; le TPM varie selon le modèle |
| Délai d'expiration de la requête | 3 600 secondes | 600 secondes | 600 secondes |
| Prise en charge des protocoles | HTTP, SSE, WebSocket, WebRTC, AOQ (AI over QUIC) | HTTP, SSE, WebSocket | HTTP, SSE |
| SLA | 99,9 % | 99,9 % | Non fourni |
Informations d'accès par région
Chaque région possède son propre domaine d'accès, sa clé API et sa liste de modèles. Ces éléments ne peuvent pas être utilisés entre différentes régions.
Région | ID de région | Domaine dédié à l'espace de travail | Domaine DashScope | Domaine d'essai | Clé API | Liste des modèles |
|---|---|---|---|---|---|---|
Chine (Pékin) |
|
|
|
| ||
Singapour |
|
|
|
| ||
Allemagne (Francfort) |
|
| Non pris en charge | Pas encore pris en charge | ||
Japon (Tokyo) |
|
| Non pris en charge | Pas encore pris en charge | ||
Chine (Hong Kong) |
|
|
|
| ||
États-Unis (Virginie) |
|
| Non pris en charge | Pas encore pris en charge |
- Les régions Allemagne (Francfort) et Japon (Tokyo), ainsi que Chine (Hong Kong) utilisent des espaces de travail pour séparer les portées de déploiement de service. Avant d'effectuer des appels API, accédez à la page de gestion des espaces de travail pour créer un espace de travail et sélectionner une portée de déploiement de service : Allemagne (Francfort) (Global/EU), Japon (Tokyo) (Global/Japon), Chine (Hong Kong) (Global/Hong Kong).
- Région États-Unis (Virginie) : utilisez les noms de modèles avec le suffixe
-us(par exempleqwen-plus-us) pour restreindre l'inférence aux États-Unis. Sans ce suffixe, l'inférence utilise par défaut la portée Global. - Les régions Chine (Pékin) et Singapour ne prennent chacune en charge qu'une seule portée de déploiement de service (respectivement Chine continentale et International), aucune sélection n'est donc nécessaire.
Migrer vers un domaine dédié à l'espace de travail
La migration depuis un domaine DashScope ou un domaine d'essai vers un domaine dédié à l'espace de travail ne nécessite que deux étapes, sans modification du code de votre logique métier :
-
Obtenez le domaine dédié à l'espace de travail : sur la page Gestion des espaces de travail, copiez le contenu de la colonne API Host.
-
Remplacez le domaine dans l'URL de la requête : remplacez le domaine d'origine dans votre code par l'hôte API copié (par exemple,
llm-xxx.cn-beijing.maas.aliyuncs.com). En prenant la région Chine (Pékin) comme exemple, oùllm-xxxcorrespond à l'ID de l'espace de travail :- Compatible OpenAI : remplacez
https://dashscope.aliyuncs.com/compatible-mode/v1parhttps://llm-xxx.cn-beijing.maas.aliyuncs.com/compatible-mode/v1 - DashScope : remplacez
https://dashscope.aliyuncs.com/api/v1parhttps://llm-xxx.cn-beijing.maas.aliyuncs.com/api/v1 - Compatible Anthropic : remplacez
https://dashscope.aliyuncs.com/apps/anthropicparhttps://llm-xxx.cn-beijing.maas.aliyuncs.com/apps/anthropic
- Compatible OpenAI : remplacez
Disponibilité des fonctionnalités par région
Fonctionnalité | Singapour | États-Unis (Virginie) | Chine (Pékin) | Chine (Hong Kong) | Allemagne (Francfort) | Japon (Tokyo) |
|---|---|---|---|---|---|---|
Inférence en temps réel | Prise en charge | Prise en charge | Prise en charge | Prise en charge | Prise en charge | Prise en charge |
Inférence par lots | Prise en charge | Non pris en charge | Prise en charge | Non pris en charge | Non pris en charge | Non pris en charge |
Playground | Prise en charge | Prise en charge | Prise en charge | Prise en charge | Prise en charge | Prise en charge |
Surveillance (standard) | Prise en charge | Prise en charge | Prise en charge | Prise en charge | Prise en charge | Prise en charge |
Surveillance (avancée) | Prise en charge | Prise en charge | Prise en charge | Non pris en charge | Non pris en charge | Non pris en charge |
Alertes | Prise en charge | Non pris en charge | Prise en charge | Non pris en charge | Non pris en charge | Non pris en charge |
Sécurité des transmissions | Prise en charge | Prise en charge | Prise en charge | Prise en charge | Prise en charge | Prise en charge |
Autorisations | Prise en charge | Prise en charge | Prise en charge | Prise en charge | Prise en charge | Prise en charge |
Fine-tuning | Prise en charge | Non pris en charge | Prise en charge | Non pris en charge | Non pris en charge | Non pris en charge |
FAQ
Dois-je utiliser une région hors de Chine pour appeler l'API Model Studio (par exemple, pour appeler des modèles deepseek) ?Non. Vous pouvez appeler tous les modèles, y compris deepseek, depuis une région de Chine continentale telle que Chine (Pékin). Les régions internationales sont optionnelles.
Configurez des modèles tels que deepseek avec une clé API Model Studio. Les clés API Model Studio prennent en charge à la fois la méthode de facturation au paiement à l'utilisation et la méthode basée sur les forfaits de jetons, et toutes deux prennent en charge les modèles deepseek.
Pour configurer un modèle, créez une clé API dans la console Model Studio, puis utilisez l'URL de base compatible OpenAI conjointement avec la clé API pour appeler le modèle.
Références
- Référence de l'API Qwen
- Modèles recommandés — Modèles et longueurs de contexte par région
- Tarification de l'inférence de modèles — Tarification par région
- Limitation de débit— Limites RPM et TPM
- Obtenir une clé API — Créer et gérer des clés
- Présentation de l'URL de base — URLs d'accès aux API de modèles
- Référence de l'API Realtime