Migrez votre application Anthropic vers Model Studio en modifiant trois paramètres. Cette rubrique détaille les paramètres de requête et de réponse, avec des exemples de code.
Pour migrer une application Anthropic existante vers Model Studio, modifiez les paramètres suivants :
api_key: Remplacez cette valeur par la clé API Model Studio.base_url: Utilisez un endpoint Model Studio listé ci-dessous.model: Spécifiez le nom d'un modèle pris en charge, tel queqwen3.7-plus.
ImportantAlibaba Cloud Model Studio a publié des domaines spécifiques à chaque espace de travail pour les régions Chine (Pékin), Singapour et Chine (Hong Kong). Ces nouveaux domaines dédiés offrent des performances supérieures et une stabilité accrue pour les requêtes d'inférence. Nous vous recommandons de migrer vers ces nouveaux domaines :
- Chine (Pékin) : passez de
https://dashscope.aliyuncs.comàhttps://{WorkspaceId}.cn-beijing.maas.aliyuncs.com - Singapour : passez de
https://dashscope-intl.aliyuncs.comàhttps://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com - Chine (Hong Kong) : passez de
https://cn-hongkong.dashscope.aliyuncs.comàhttps://{WorkspaceId}.cn-hongkong.maas.aliyuncs.com
{WorkspaceId} correspond à l'ID de votre espace de travail, disponible sur la page Workspace Details dans la console Alibaba Cloud Model Studio. Le domaine existant reste pleinement fonctionnel.
Singapore
SDK base_url :https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/apps/anthropic
URL de requête HTTP :POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/apps/anthropic/v1/messages
China (Beijing)
SDK base_url :https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/apps/anthropic
URL de requête HTTP :POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/apps/anthropic/v1/messages
Germany (Frankfurt)
SDK base_url :https://{WorkspaceId}.eu-central-1.maas.aliyuncs.com/apps/anthropic
URL de requête HTTP :POST https://{WorkspaceId}.eu-central-1.maas.aliyuncs.com/apps/anthropic/v1/messages
US (Virginia)
SDK base_url :https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/apps/anthropic
URL de requête HTTP :POST https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/apps/anthropic/v1/messages
Japan (Tokyo)
SDK base_url :https://{WorkspaceId}.ap-northeast-1.maas.aliyuncs.com/apps/anthropic
URL de requête HTTP :POST https://{WorkspaceId}.ap-northeast-1.maas.aliyuncs.com/apps/anthropic/v1/messages
Remplacez {WorkspaceId} par votre ID d'espace de travail.
Authentification : Transmettez votre clé API Model Studio via l'en-tête x-api-key ou Authorization: Bearer.
Corps de la requête | Appel de baseStreamingRéflexion étendueCompréhension d'imagesCompréhension vidéoAppel de fonctionMise en cache du promptSorties structurées |
model Nom du modèle. Modèles pris en charge : Modèles pris en charge Qwen-Max : qwen3.8-max, qwen3.7-max, qwen3.7-max-2026-05-20, qwen3.7-max-2026-06-08, qwen3.6-max-preview, qwen3-max, qwen3-max-2026-01-23, qwen3-max-preview Qwen-Plus : qwen3.7-plus, qwen3.7-plus-2026-05-26, qwen3.6-plus, qwen3.6-plus-2026-04-02, qwen3.5-plus, qwen3.5-plus-2026-04-20, qwen3.5-plus-2026-02-15, qwen-plus, qwen-plus-latest, qwen-plus-2025-09-11 Qwen-Flash : qwen3.7-flash, qwen3.7-flash-2026-07-15, qwen3.6-flash, qwen3.6-flash-2026-04-16, qwen3.5-flash, qwen3.5-flash-2026-02-23, qwen-flash, qwen-flash-2025-07-28 Qwen-Turbo : qwen-turbo Qwen-Coder : qwen3-coder-next, qwen3-coder-plus, qwen3-coder-plus-2025-09-23, qwen3-coder-flash Qwen-VL : qwen3-vl-plus, qwen3-vl-flash, qwen-vl-max, qwen-vl-plus Modèles open source Qwen : qwen3.6-27b, qwen3.5-397b-a17b, qwen3.5-122b-a10b, qwen3.5-27b, qwen3.5-35b-a3b Modèles tiersdeepseek-v4-pro, deepseek-v4-flash, deepseek-v4-flash-0731, deepseek-v3.2, kimi-k2.7-code, kimi-k2.6, kimi-k2.5, kimi-k2-thinking, glm-5.2, glm-5.1, glm-5, glm-4.7, glm-4.6, MiniMax-M2.5, MiniMax-M2.1 | |
max_tokens
| |
system Prompt système définissant le comportement du modèle. Une chaîne équivaut à un seul bloc Propriétés type Valeur fixe : text Texte du prompt système. cache_control Point d'arrêt de mise en cache du prompt. En cas de succès du cache, les requêtes suivantes sont facturées au tarif de lecture du cache. Contient uniquement | |
messages Tableau des messages, organisé en tours alternés Élément du tableau messages role Rôle du message. Valeurs valides : content Chaîne de texte brut ou tableau de contenu structuré. Une chaîne équivaut à un seul bloc Types d'éléments du tableau content Texte Propriétés type Valeur fixe : text Contenu textuel. cache_control Point d'arrêt de mise en cache du prompt. Contient uniquement Image (nécessite un modèle visuel) Propriétés type Valeur fixe : source Source des données de l'image. Propriétés type Valeurs valides : url URL publique de l'image. Obligatoire lorsque media_type Type MIME de l'image, par exemple data Données de l'image encodées en Base64. Obligatoire lorsque Vidéo (nécessite un modèle visuel) Propriétés type Valeur fixe : source Source des données vidéo. Propriétés type Valeurs valides : url URL publique de la vidéo. Obligatoire lorsque media_type Type MIME de la vidéo, par exemple data Données vidéo encodées en Base64. Obligatoire lorsque Utilisation d'outil (rôle assistant ; instruction d'appel d'outil renvoyée par le modèle) Propriétés type Valeur fixe : id Identifiant unique de l'appel d'outil, utilisé pour associer le résultat dans un name Nom de l'outil appelé. input Paramètres d'entrée de l'appel d'outil. La structure dépend du cache_control Point d'arrêt de mise en cache du prompt. Contient uniquement Résultat d'outil (rôle user ; résultat d'exécution d'un outil renvoyé au modèle) Propriétés type Valeur fixe : tool_use_id Correspond à l' content Contenu renvoyé par l'outil. cache_control Point d'arrêt de mise en cache du prompt. Contient uniquement | |
stream Active ou désactive le streaming. Valeur par défaut : | |
temperature Contrôle la diversité du texte généré. Plage de valeurs : [0, 2). Des valeurs plus élevées produisent des résultats plus aléatoires. RemarqueCette plage diffère de la plage officielle d'Anthropic ([0,0, 1,0]). Lors d'une migration depuis Anthropic, vérifiez la valeur de ce paramètre. | |
top_p Seuil de probabilité pour l'échantillonnage par noyau.
| |
top_k Taille de l'ensemble de candidats lors de l'échantillonnage. | |
stop_sequences Séquences de texte déclenchant l'arrêt de la génération. La sortie se termine avant la séquence correspondante. RemarqueAprès une correspondance, | |
thinking Configuration de la réflexion étendue. Lorsqu'elle est activée, le modèle raisonne avant de répondre et la réponse inclut des blocs de contenu de type Propriétés type Valeurs valides : budget_tokens Nombre maximal de tokens pour le processus de réflexion. Indépendant de | |
tools Définitions d'outils pour l'appel de fonction. Élément du tableau tools name Nom de l'outil. description Description de la fonction de l'outil. input_schema Définition JSON Schema des paramètres d'entrée de l'outil. | |
tool_choice Stratégie de sélection d'outil :
| |
output_config Propriétés effort Contrôle l'intensité d'inférence des modèles. Les valeurs valides et les valeurs par défaut varient selon le modèle. Valeur par défaut : Valeurs valides :
low et medium correspondent à high, et xhigh correspond à max. Modèles pris en charge : qwen3.8-max, glm-5.2, deepseek-v4-pro et deepseek-v4-flash. format Configuration des sorties structurées. Lorsqu'elle est activée, le modèle renvoie une chaîne JSON. Le comportement varie selon le modèle :
Propriétés type Valeur fixe : schema Objet JSON Schema conforme à la spécification standard. Doit inclure |
Réponse non-streaming | Exemple de réponse |
id Identifiant unique du message. | |
type Valeur fixe : | |
role Valeur fixe : | |
model Modèle utilisé pour la génération. | |
content Tableau de contenu. Types d'éléments du tableau content Texte Propriétés type Valeur fixe : text Réponse textuelle générée par le modèle. Réflexion (renvoyé lorsque la réflexion étendue est activée) Propriétés type Valeur fixe : thinking Raisonnement du modèle avant la réponse finale. signature Actuellement fixée à une chaîne vide. Utilisation d'outil (scénario d'appel de fonction) Propriétés type Valeur fixe : id Identifiant unique de l'appel d'outil, utilisé pour faire correspondre le name Nom de l'outil appelé. input Paramètres d'entrée de l'appel d'outil. | |
stop_reason Raison de l'arrêt de la génération. Valeurs valides : | |
stop_sequence Toujours | |
usage Statistiques d'utilisation des tokens. RemarqueDans les appels en streaming, le champ Propriétés input_tokens Tokens d'entrée. output_tokens Tokens de sortie. cache_creation_input_tokens Tokens consommés pour la création du cache. cache_read_input_tokens Tokens consommés par les lectures du cache. |
Réponse en streaming | Exemple de réponse en streaming |
| message_start Premier événement du flux, marque le début du message. Propriétés type Valeur fixe : message Objet message initial. | |
| content_block_start Marque le début d'un bloc de contenu. Propriétés type Valeur fixe : index Index basé sur 0 correspondant à la position dans le tableau content_block Objet initial du bloc de contenu. La valeur de | |
| content_block_delta Mise à jour incrémentielle du bloc de contenu. Plusieurs deltas sont envoyés par bloc. Propriétés type Valeur fixe : index Index du bloc de contenu associé. delta Objet delta. Valeurs de
| |
| content_block_stop Marque la fin d'un bloc de contenu. Propriétés type Valeur fixe : index Index du bloc de contenu terminé. | |
| message_delta Envoyé après la fin de tous les blocs de contenu. Contient la raison d'arrêt et l'utilisation finale des tokens. Propriétés type Valeur fixe : delta Contient usage Statistiques complètes d'utilisation des tokens, incluant | |
| message_stop Dernier événement, marque la fin du message. Propriétés type Valeur fixe : De plus, les réponses en streaming envoient périodiquement des événements ping ( |
FAQ
Après avoir configuré Claude Desktop ou Claude Code, le test de connexion échoue avecModel discovery — Gateway /v1/models returned HTTP 404, ou l'URL de requête contient/v1/v1/models. Comment résoudre ce problème ?La fonctionnalité de découverte de modèles des clients tels que Claude Desktop et Claude Code ajoute automatiquement /v1/models à l'URL de base configurée. Vérifiez les deux points suivants :
- Ne terminez pas l'URL de base par/v1/ : elle doit se terminer par
/apps/anthropic(par exemple, pour Chine (Pékin), utilisezhttps://dashscope.aliyuncs.com/apps/anthropic; consultez les informations d'endpoint ci-dessus pour les autres régions). Si vous saisissez par erreur.../apps/anthropic/v1/, le client ajoute/v1/modelset produit le chemin dupliqué/v1/v1/models, ce qui renvoie une erreur HTTP 404. Par conséquent, si vous obtenez une erreur 404, vérifiez d'abord si l'URL de requête réelle contient un doublon/v1/v1/; le cas échéant, supprimez le/v1/final de l'URL de base. - Ajoutez manuellement des modèles pour ignorer la découverte : L'endpoint compatible Anthropic de Model Studio fournit uniquement l'API Messages (
/v1/messages) et ne propose pas d'endpoint de liste de modèles (/v1/models), de sorte que la requête de découverte de modèles renvoie également une erreur 404. Ajoutez manuellement des modèles (par exemple,qwen3.7-plus) sous Models dans le client pour contourner la découverte automatique.