Tous les produits
Search
Centre de documentation

:QuerySmarttagJob

Dernière mise à jour :Aug 07, 2026

Consulte une tâche d'étiquetage intelligent.

Testez maintenant

Testez cette API dans OpenAPI Explorer, sans signature manuelle. Les appels réussis génèrent automatiquement du code SDK correspondant à vos paramètres. Téléchargez-le avec une sécurité intégrée des identifiants pour une utilisation locale. Testez cette API dans OpenAPI Explorer, sans signature manuelle. Les appels réussis génèrent automatiquement du code SDK correspondant à vos paramètres. Téléchargez-le avec une sécurité intégrée des identifiants pour une utilisation locale.

Test

Autorisation RAM

Le tableau ci-dessous décrit les autorisations nécessaires pour appeler cette API. Vous pouvez les définir dans une politique Resource Access Management (RAM). Les colonnes du tableau sont détaillées ci-dessous :

  • Action : les actions peuvent être utilisées dans l'élément Action des instructions de politique de permissions RAM pour accorder les autorisations nécessaires à l'exécution de l'opération.

  • API : l'API que vous pouvez appeler pour exécuter l'action.

  • Niveau d'accès : le niveau d'accès prédéfini accordé pour chaque API. Valeurs valides : create, list, get, update et delete.

  • Type de ressource : le type de ressource qui prend en charge l'autorisation pour exécuter l'action. Il indique si l'action prend en charge les permissions au niveau de la ressource. La ressource spécifiée doit être compatible avec l'action. Sinon, la politique sera inefficace.

    • Pour les API avec permissions au niveau de la ressource, les types de ressource requis sont marqués d'un astérisque (*). Spécifiez l'Alibaba Cloud Resource Name (ARN) correspondant dans l'élément Resource de la politique.

    • Pour les API sans permissions au niveau de la ressource, la valeur All Resources est affichée. Utilisez un astérisque (*) dans l'élément Resource de la politique.

  • Clé de condition : les clés de condition définies par le service. La clé permet un contrôle granulaire, applicable aux actions seules ou aux actions associées à des ressources spécifiques. En plus des clés de condition propres au service, Alibaba Cloud fournit un ensemble de clés de condition communes applicables à tous les services pris en charge par RAM.

  • Action dépendante : les actions dépendantes requises pour exécuter l'action. Pour mener à bien l'opération, l'utilisateur RAM ou le rôle RAM doit disposer des permissions pour toutes les actions dépendantes.

ice:QuerySmarttagJob

get

*All Resource

*

Aucune Aucune

Paramètres de requête

Paramètre

Type

Requis

Description

Exemple

JobId

string

Oui

L'identifiant de la tâche d'étiquetage intelligent. Vous pouvez obtenir cet identifiant à partir de la réponse à l'appel SubmitSmarttagJob.

88c6ca184c0e47098a5b665e2****

Params

string

Non

Paramètres de requête supplémentaires, formatés sous forme de chaîne JSON. Par exemple : {"labelResultType":"auto"}. Le paramètre labelResultType prend en charge les valeurs suivantes :

  • auto : résultats d'étiquetage générés par une machine

  • hmi : résultats d'étiquetage avec intervention humaine

{"labelResultType":"auto"}

Éléments de réponse

Élément

Type

Description

Exemple

object

JobStatus

string

L'état de la tâche. Valeurs valides :

  • Success : la tâche a réussi.

  • Fail : la tâche a échoué.

  • Processing : la tâche est en cours de traitement.

  • Submitted : la tâche est en file d'attente pour traitement.

Success

RequestId

string

L'identifiant de la requête.

******11-DB8D-4A9A-875B-275798******

UserData

string

Les données personnalisées transmises via le rappel MNS. Pour plus de détails sur le format du message, consultez les définitions du format de message de rappel ci-dessous.

{"userId":"123432412831"}

Results

object

Result

array<object>

Un tableau d'objets de résultat d'analyse.

object

Type

string

The type of the analysis result.

  • - Analysis result types for Tagging v1.0:

  1. TextLabel: text labels

  2. VideoLabel: video labels

  3. ASR: Raw results from automatic speech recognition. This is not returned by default.

  4. OCR: Raw results from optical character recognition. This is not returned by default.

  5. NLP: Results from natural language processing. This is not returned by default.

  • - Analysis result types for Tagging v2.0:

  1. CPVLabel

  2. Meta: Metadata such as the video title. This is not returned by default.

  • - Analysis result types for Tagging v2.0-custom:

  1. CPVLabel

  2. Meta: Metadata such as the video title. This is not returned by default.

Meta

Data

string

The analysis result data, formatted as a JSON string. The data structure depends on the Type value. For more information, see the Result parameter descriptions below.

{"title":"example-title-****"}

Usages

object

Usage

array<object>

object

Type

string

Quota

integer

Format du message de rappel\nLorsque l'état d'exécution d'une tâche d'étiquetage intelligent change, MPS envoie un message de rappel à une file d'attente que vous spécifiez à l'aide de l'API UpdatePipeline de MPS. Le corps du message est une chaîne JSON contenant les champs suivants :

ParamètreTypeDescription
TypestringUne chaîne fixe avec la valeur smarttag, indiquant une tâche d'étiquetage intelligent.
JobIdstringL'identifiant unique de la tâche.
StatestringL'état actuel de la tâche. Cette valeur correspond au JobStatus renvoyé par l'opération QuerySmarttagJob.
StatestringL'état actuel de la tâche. Cette valeur correspond au JobStatus renvoyé par l'opération QuerySmarttagJob.
UserDatastringLes données utilisateur transmises à l'opération SubmitSmarttagJob.
UserDatastringLes données utilisateur transmises à l'opération SubmitSmarttagJob.

Paramètres de résultat

Structure de données VideoLabel

ParamètreTypeDescription
personsJSONArrayUn tableau d'objets, chacun représentant une personne détectée.
persons.nameStringLe nom de la personne reconnue.
persons.categoryStringLa catégorie de la personne. Les valeurs possibles sont : celebrity, politician, sensitive (personne sensible) et unknown (personne inconnue). Pour une personne issue d'une bibliothèque de personnes personnalisée, ce champ contient l'identifiant de la bibliothèque.
persons.ratiodoubleLe ratio d'apparition de la personne. La valeur est comprise entre 0 et 1.
persons.occurrencesJSONArrayUn tableau d'objets, chacun détaillant une apparition de la personne.
persons.occurrences.scoredoubleLe score de confiance pour la reconnaissance.
persons.occurrences.fromdoubleL'heure de début de l'apparition de la personne, en secondes.
persons.occurrences.todoubleL'heure de fin de l'apparition de la personne, en secondes.
persons.occurrences.positionJSONObjectLes coordonnées du visage.
persons.occurrences.position.leftTopint[]Les coordonnées x et y du coin supérieur gauche du cadre englobant du visage.
persons.occurrences.position.rightBottomint[]Les coordonnées x et y du coin inférieur droit du cadre englobant du visage.
persons.occurrences.timestampdoubleL'horodatage, en secondes, correspondant aux coordonnées du visage.
persons.occurrences.sceneStringLe type de plan. Les valeurs possibles sont : closeUp (gros plan), medium-closeUp (plan rapproché), medium (plan moyen) et medium-long (plan moyen-long).
tagsJSONArrayUn tableau d'objets représentant les étiquettes détectées, telles que les objets et les scènes. Voir le tableau ci-dessous pour des exemples.
tags.mainTagNameStringL'étiquette principale.
tags.subTagNameStringLa sous-étiquette.
tags.ratiodoubleLe ratio d'apparition de l'étiquette. La valeur est comprise entre 0 et 1.
tags.occurrencesJSONArrayUn tableau d'objets, chacun détaillant une apparition de l'étiquette.
tags.occurrences.scoredoubleLe score de confiance pour l'étiquette.
tags.occurrences.fromdoubleL'heure de début de l'apparition, en secondes.
tags.occurrences.todoubleL'heure de fin de l'apparition, en secondes.
classificationsJSONArrayUn tableau d'objets, chacun représentant une classification vidéo.
classifications.scoredoubleLe score de confiance pour la classification.
classifications.category1StringLa catégorie de niveau 1, telle que Lifestyle, Anime ou Automotive.
classifications.category2StringLa catégorie de niveau 2, une sous-catégorie de la catégorie de niveau 1. Par exemple, la catégorie Lifestyle inclut des sous-catégories comme Health ou Home.

Étiquettes vidéo : exemples.

ÉtiquetteExemples
program"Where Are We Going, Dad?", "Top Funny Comedian"
charactermédecin, infirmière, enseignant
objectpiano, tasse, table, œufs brouillés aux tomates, voiture, cosmétiques
logoCCTV-1, CCTV-2, Youku, Dragon TV
actiondanser, embrasser, serrer dans les bras, se réunir, chanter, passer un appel téléphonique, faire du cheval, se battre
locationPlace Tian'anmen, Statue de la Liberté, Grand Bouddha de Leshan, Chine, États-Unis
scenechambre, station de métro, rizières en terrasses, plage, désert

Structure de données ImageLabel

ParamètreTypeDescription
personsJSONArrayUn tableau d'objets, chacun représentant une personne détectée.
persons.nameStringLe nom de la personne reconnue.
persons.categoryStringLa catégorie de la personne. Les valeurs valides sont celebrity, politician et sensitive.
persons.scoredoubleLe score de confiance pour la personne détectée.
persons.positionJSONObjectLes coordonnées du visage.
persons.position.leftTopint[]Les coordonnées x et y du coin supérieur gauche du cadre englobant.
persons.position.rightBottomint[]Les coordonnées x et y du coin inférieur droit du cadre englobant.
persons.sceneStringLe plan de la caméra. Les valeurs valides incluent : closeUp (gros plan), medium-closeUp (plan rapproché), medium (plan moyen) et medium-long (plan moyen-long).
tagsJSONArrayÉtiquettes pour les objets et scènes détectés. Pour plus d'informations, consultez les exemples dans le tableau ci-dessous.
tags.mainTagNameStringL'étiquette principale.
tags.subTagNameStringLa sous-étiquette.
tags.scoredoubleLe score de confiance pour l'étiquette.

Exemples d'étiquettes d'image.

Étiquette principaleSous-étiquette
characterpar ex., médecin, infirmière, enseignant
locationpar ex., Place Tian'anmen, Statue de la Liberté, Grand Bouddha de Leshan, Chine, États-Unis
actionpar ex., parler
logopar ex., CCTV1, CCTV2, Youku, Dragon TV
actionpar ex., danser, embrasser, serrer dans les bras, se réunir, chanter, passer un appel téléphonique, faire du cheval, se battre
objectpar ex., piano, tasse, table, œufs brouillés aux tomates, voiture, cosmétiques
scenepar ex., chambre, station de métro, rizières en terrasses, plage, désert

Structure de données TextLabel (Source : ASR et OCR)

ParamètreTypeDescription
tagsJSONArrayUne liste d'étiquettes pour la ressource.
tags.nameStringLa clé de l'étiquette.
tags.valueStringLa valeur de l'étiquette. Utilisez une virgule pour séparer plusieurs valeurs.

Exemples d'étiquettes d'image.

ParamètreValeur
regionExemples : Place Tian'anmen, Statue de la Liberté, Grand Bouddha de Leshan, Chine, États-Unis
organizationExemples : Association chinoise pour la conservation de la faune sauvage, China Media Group
logoExemples : Nike, Li-Ning
keywordExemple : force centrale

Structure de données CPVLabel

  • cates : catégories hiérarchiques (par ex., niveau 1, niveau 2 et niveau 3).

  • entities : attributs de catégorie (enrichis avec les informations du graphe de connaissances).

  • hotwords : mots-clés populaires (termes reflétant l'intérêt de l'utilisateur).

  • freeTags : étiquettes libres (mots-clés définis par l'utilisateur).

ParamètreTypeValeur d'exempleDescription
typeStringhmiLe type de résultat. Valeurs valides : hmi (résultat d'interaction homme-machine) et autp (résultat d'étiquetage automatisé).
catesJSONArray-Les résultats de classification des catégories.
cates.labelLevel1StringTravelL'étiquette de niveau 1.
cates.labelLevel2StringTravel SceneryL'étiquette de niveau 2.
cates.labelString""Le nom de l'étiquette. L'algorithme peut renvoyer une chaîne vide.
cates.appearanceProbabilitydouble0.96La probabilité d'apparition.
cates.detailInfoJSONArray-Informations détaillées sur la catégorie.
cates.detailInfo.scoredouble0.9Le score de confiance.
cates.detailInfo.startTimedouble0.021L'heure de début.
cates.detailInfo.endTimedouble29.021L'heure de fin.
entitiesJSONArray-Entités détectées.
entities.labelLevel1StringRegionL'étiquette de niveau 1.
entities.labelLevel2StringLandmarkL'étiquette de niveau 2.
entities.labelStringHuangguoshu WaterfallLe nom de l'étiquette.
entities.appearanceProbabilitydouble0.067La probabilité d'apparition.
entities.knowledgeInfoString{"name": "黄果树瀑布", "nameEn": "Huangguoshu Waterfall", "description": "亚洲四大瀑布之一"}Informations provenant du graphe de connaissances. Pour une liste complète des champs, reportez-vous aux tableaux des types de graphes de connaissances suivants : IP de cinéma et de télévision, musique, personne, point de repère et objet.
entities.detailInfoJSONArray-Informations détaillées sur l'entité.
entities.detailInfo.scoredouble0.33292606472969055Le score de confiance.
entities.detailInfo.startTimedouble6.021L'heure de début.
entities.detailInfo.endTimedouble8.021L'heure de fin.
entities.detailInfo.trackDataJSONArray-Les informations structurées de l'étiquette d'entité.
entities.detailInfo.trackData.scoredouble0.32Le score de confiance.
entities.detailInfo.trackData.bboxinteger[]23,43,45,67Les coordonnées du cadre englobant.
entities.detailInfo.trackData.timestampdouble7.9L'horodatage.
hotwordsJSONArray-Mots-clés populaires détectés.
hotwords.labelLevel1StringkeywordL'étiquette de niveau 1.
hotwords.labelLevel1StringkeywordL'étiquette de niveau 1.
hotwords.labelLevel2String""L'étiquette de niveau 2.
hotwords.labelString中国气象局Le contenu du mot-clé populaire.
hotwords.appearanceProbabilitydouble0.96La probabilité d'apparition.
hotwords.detailInfoJSONArrayInformations détaillées sur le mot-clé populaire.
hotwords.detailInfo.scoredouble1.0Le score de confiance.
hotwords.detailInfo.startTimedouble0.021L'heure de début.
hotwords.detailInfo.endTimedouble29.021L'heure de fin.
freeTagsJSONArrayLes étiquettes libres.
freeTags.labelLevel1StringkeywordL'étiquette de niveau 1.
freeTags.labelLevel2String""L'étiquette de niveau 2.
freeTags.labelString中央气象台Le contenu de l'étiquette.
freeTags.appearanceProbabilitydouble0.96La probabilité d'apparition.
freeTags.detailInfoJSONArrayInformations détaillées sur l'étiquette libre.
freeTags.detailInfo.scoredouble0.9Le score de confiance.
freeTags.detailInfo.startTimedouble0.021L'heure de début.
freeTags.detailInfo.endTimedouble29.021L'heure de fin.

Résultat ASR

ParamètreTypeDescription
detailsJSONArrayRésultats détaillés de la tâche.
details.fromdoubleHorodatage de début du segment de parole, en secondes.
details.todoubleHorodatage de fin du segment de parole, en secondes.
details.contentStringTexte transcrit du segment de parole.

Résultats OCR

ParamètreTypeDescription
detailsJSONArrayUn tableau d'objets contenant les détails de la tâche.
details.timestampdoubleL'horodatage, en secondes.
details.infoJSONArrayUn tableau d'objets, chacun contenant les informations reconnues pour l'horodatage correspondant.
details.info.scoredoubleLe score de confiance.
details.info.positionJSONObjectLes coordonnées du texte.
details.info.position.leftTopint[]Les coordonnées du coin supérieur gauche.
details.info.position.rightBottomint[]Les coordonnées du coin inférieur droit.
details.info.contentStringLe contenu du texte reconnu.

Résultats d'annotation des métadonnées

Remarque

Si vous n'utilisez pas l'annotation humaine et que vous spécifiez le paramètre needMetaData lors de la soumission d'une tâche avec SubmitSmarttagJob , QuerySmarttagJob renverra le title original que vous avez saisi.

ParamètreTypeDescription
titleStringLe titre.

Résultats d'extraction des sous-titres

ParamètreTypeDescription
detailsJSONArrayRésultats détaillés de la tâche.
details.allResultUrlStringURL pour tous les résultats de sous-titres. L'URL est valide pendant six mois après la fin de la tâche.
details.chResultUrlStringURL pour les résultats de sous-titres en chinois. L'URL est valide pendant six mois après la fin de la tâche.
details.engResultUrlStringURL pour les résultats de sous-titres en anglais. L'URL est valide pendant six mois après la fin de la tâche.
Remarque

L'URL du résultat des sous-titres renvoie le contenu au format suivant : numéro de séquence + plage de temps + contenu du sous-titre (un sous-titre par ligne).

Résultats NLP

ParamètreTypeDescription
transcriptionobjectLa sortie de la conversion parole-texte.
autoChaptersobjectLes chapitres générés automatiquement.
summarizationobjectLe résumé généré par le grand modèle.
meetingAssistanceobjectLe compte-rendu de réunion intelligent.
translationobjectLe texte traduit.

Transcription

ParamètreTypeDescription
transcriptionobjectLe résultat de la transcription de la parole.
transcription.paragraphslist[]Une liste de paragraphes dans la transcription de la parole.
transcription.paragraphs[i].paragraphIdstringL'identifiant au niveau du paragraphe.
transcription.paragraphs[i].speakerIdstringL'identifiant du locuteur.
transcription.paragraphs[i].wordslist[]Une liste de mots dans le paragraphe.
transcription.paragraphs[i].words[i].idintLe numéro de séquence du mot. Ce champ peut généralement être ignoré.
transcription.paragraphs[i].words[i].sentenceIdintL'identifiant de la phrase. Les mots avec le même sentenceId forment une phrase.
transcription.paragraphs[i].words[i].startlongL'heure de début du mot, en millisecondes, par rapport au début de l'audio.
transcription.paragraphs[i].words[i].endlongL'heure de fin du mot, en millisecondes, par rapport au début de l'audio.
transcription.paragraphs[i].words[i].textstringLe texte du mot.

Résumé : résumé du texte intégral, résumé par locuteur et résumé des questions

ParamètreTypeDescription
summarizationobjectL'objet de résultat de résumé, qui peut contenir des résultats pour plusieurs types de résumé.
summarization.paragraphSummarystringLe résultat du résumé de paragraphe.
summarization.conversationalSummarylist[]Une liste de résultats de résumé conversationnel.
summarization.conversationalSummary[i].speakerIdstringL'identifiant du locuteur.
summarization.conversationalSummary[i].speakerNamestringLe nom du locuteur.
summarization.conversationalSummary[i].summarystringLe résumé pour le locuteur.
summarization.questionsAnsweringSummarylist[]Une liste de résultats de résumé de questions-réponses.
summarization.questionsAnsweringSummary[i].questionstringLa question extraite de la transcription de la parole.
summarization.questionsAnsweringSummary[i].sentenceIdsOfQuestionlist[]Identifiants des phrases de la transcription de la parole originale qui forment la question.
summarization.questionsAnsweringSummary[i].answerstringLa réponse à la question.
summarization.questionsAnsweringSummary[i].sentenceIdsOfAnswerlist[]Les identifiants des phrases de la transcription de la parole originale qui sont résumées dans la réponse.
summarization.mindMapSummarylist[object]Une liste de résultats de résumé de carte mentale, qui peut inclure des résumés de sujets et leurs relations.
summarization.mindMapSummary[i].titlestringLe titre de la carte mentale.
summarization.mindMapSummary[i].topiclist[object]Une liste des sujets principaux, chacun avec ses sous-sujets respectifs.
summarization.mindMapSummary[i].topic[i].titlestringLe titre du sujet.
summarization.mindMapSummary[i].topic[i].topiclist[object]Une liste de sous-sujets pour le sujet actuel, qui peut être vide.

Traduction du texte intégral

ParamètreTypeDescription
translationobjectL'objet de traduction.
translation.paragraphslist[]Une liste de paragraphes traduits, correspondant au résultat de la reconnaissance vocale.
translation.paragraphs.paragraphIdstringL'identifiant du paragraphe, qui correspond au ParagraphId du résultat de la reconnaissance vocale.
translation.paragraphs.sentenceslist[]Les phrases qui composent le paragraphe.
translation.paragraphs.sentences[i].sentenceIdlongL'identifiant unique de la phrase.
translation.paragraphs.sentences[i].startlongL'heure de début de la phrase en millisecondes, par rapport au début de l'audio.
translation.paragraphs.sentences[i].endlongL'heure de fin de la phrase en millisecondes, par rapport au début de l'audio.
translation.paragraphs.sentences[i].textstringLe texte traduit de la phrase.

autoChapters (reconnaissance de chapitres)

ParamètreTypeDescription
autoChapterslist[]Une liste d'objets d'aperçu de chapitre.
autoChapters[i].idintIdentifiant du chapitre.
autoChapters[i].startlongL'heure de début du chapitre, sous forme d'horodatage relatif en millisecondes à partir du début de l'audio.
autoChapters[i].endlongL'heure de fin du chapitre, sous forme d'horodatage relatif en millisecondes à partir du début de l'audio.
autoChapters[i].headlinestringTitre du chapitre.
autoChapters[i].summarystringRésumé du chapitre.

meetingAssistance (résumé, mot-clé, phrase clé et extraction d'éléments d'action)

ParamètreTypeDescription
meetingAssistanceobjectL'objet de résultats de compte-rendu intelligent, qui peut contenir zéro ou plusieurs résultats de différents types.
meetingAssistance.keywordslist[]Les résultats d'extraction de mots-clés.
meetingAssistance.keySentenceslist[]Les résultats d'extraction de phrases clés, également appelés contenu clé.
meetingAssistance.keySentences[i].idlongL'identifiant de la phrase clé.
meetingAssistance.keySentences[i].sentenceIdlongL'identifiant de la phrase correspondante dans la transcription ASR originale.
meetingAssistance.keySentences[i].startlongL'heure de début par rapport au début de l'audio, en millisecondes.
meetingAssistance.keySentences[i].endlongL'heure de fin par rapport au début de l'audio, en millisecondes.
meetingAssistance.keySentences[i].textstringLe texte de la phrase clé.
meetingAssistance.actionslist[]Une liste d'éléments d'action.
meetingAssistance.actions[i].idlongL'identifiant de l'élément d'action.
meetingAssistance.actions[i].sentenceIdlongL'identifiant de la phrase correspondante dans la transcription ASR originale.
meetingAssistance.actions[i].startlongL'heure de début par rapport au début de l'audio, en millisecondes.
meetingAssistance.actions[i].endlongL'heure de fin par rapport au début de l'audio, en millisecondes.
meetingAssistance.actions[i].textstringLe texte de l'élément d'action.
meetingAssistance.classificationsobjectLes résultats de classification de scène. Actuellement, seuls trois types de scènes sont pris en charge.
meetingAssistance.classifications.interviewfloatLe score de confiance pour la scène d'entretien.
meetingAssistance.classifications.lecturefloatLe score de confiance pour la scène de cours magistral.
meetingAssistance.classifications.meetingfloatLe score de confiance pour la scène de réunion.

Exemples

JSON format

{
  "JobStatus": "Success",
  "RequestId": "******11-DB8D-4A9A-875B-275798******",
  "UserData": "{\"userId\":\"123432412831\"}",
  "Results": {
    "Result": [
      {
        "Type": "Meta",
        "Data": "{\"title\":\"example-title-****\"}\t\n"
      }
    ]
  },
  "Usages": {
    "Usage": [
      {
        "Type": "",
        "Quota": 0
      }
    ]
  }
}

Codes d'erreur

Consultez Codes d'erreur pour la liste complète.

Notes de version

Consultez Notes de version pour la liste complète.