Consulte une tâche d'étiquetage intelligent.
Testez maintenant
Testez cette API dans OpenAPI Explorer, sans signature manuelle. Les appels réussis génèrent automatiquement du code SDK correspondant à vos paramètres. Téléchargez-le avec une sécurité intégrée des identifiants pour une utilisation locale. Testez cette API dans OpenAPI Explorer, sans signature manuelle. Les appels réussis génèrent automatiquement du code SDK correspondant à vos paramètres. Téléchargez-le avec une sécurité intégrée des identifiants pour une utilisation locale.
Test
Autorisation RAM
|
ice:QuerySmarttagJob |
get |
*All Resource
|
Aucune | Aucune |
Paramètres de requête
|
Paramètre |
Type |
Requis |
Description |
Exemple |
| JobId |
string |
Oui |
L'identifiant de la tâche d'étiquetage intelligent. Vous pouvez obtenir cet identifiant à partir de la réponse à l'appel SubmitSmarttagJob. |
88c6ca184c0e47098a5b665e2**** |
| Params |
string |
Non |
Paramètres de requête supplémentaires, formatés sous forme de chaîne JSON. Par exemple :
|
{"labelResultType":"auto"} |
Éléments de réponse
|
Élément |
Type |
Description |
Exemple |
|
object |
|||
| JobStatus |
string |
L'état de la tâche. Valeurs valides :
|
Success |
| RequestId |
string |
L'identifiant de la requête. |
******11-DB8D-4A9A-875B-275798****** |
| UserData |
string |
Les données personnalisées transmises via le rappel MNS. Pour plus de détails sur le format du message, consultez les définitions du format de message de rappel ci-dessous. |
{"userId":"123432412831"} |
| Results |
object |
||
| Result |
array<object> |
Un tableau d'objets de résultat d'analyse. |
|
|
object |
|||
| Type |
string |
The type of the analysis result.
|
Meta |
| Data |
string |
The analysis result data, formatted as a JSON string. The data structure depends on the |
{"title":"example-title-****"} |
| Usages |
object |
||
| Usage |
array<object> |
||
|
object |
|||
| Type |
string |
||
| Quota |
integer |
Format du message de rappel\nLorsque l'état d'exécution d'une tâche d'étiquetage intelligent change, MPS envoie un message de rappel à une file d'attente que vous spécifiez à l'aide de l'API UpdatePipeline de MPS. Le corps du message est une chaîne JSON contenant les champs suivants :
| Paramètre | Type | Description |
| Type | string | Une chaîne fixe avec la valeur smarttag, indiquant une tâche d'étiquetage intelligent. |
| JobId | string | L'identifiant unique de la tâche. |
| State | string | L'état actuel de la tâche. Cette valeur correspond au JobStatus renvoyé par l'opération QuerySmarttagJob. |
| State | string | L'état actuel de la tâche. Cette valeur correspond au JobStatus renvoyé par l'opération QuerySmarttagJob. |
| UserData | string | Les données utilisateur transmises à l'opération SubmitSmarttagJob. |
| UserData | string | Les données utilisateur transmises à l'opération SubmitSmarttagJob. |
Paramètres de résultat
Structure de données VideoLabel
| Paramètre | Type | Description |
| persons | JSONArray | Un tableau d'objets, chacun représentant une personne détectée. |
| persons.name | String | Le nom de la personne reconnue. |
| persons.category | String | La catégorie de la personne. Les valeurs possibles sont : celebrity, politician, sensitive (personne sensible) et unknown (personne inconnue). Pour une personne issue d'une bibliothèque de personnes personnalisée, ce champ contient l'identifiant de la bibliothèque. |
| persons.ratio | double | Le ratio d'apparition de la personne. La valeur est comprise entre 0 et 1. |
| persons.occurrences | JSONArray | Un tableau d'objets, chacun détaillant une apparition de la personne. |
| persons.occurrences.score | double | Le score de confiance pour la reconnaissance. |
| persons.occurrences.from | double | L'heure de début de l'apparition de la personne, en secondes. |
| persons.occurrences.to | double | L'heure de fin de l'apparition de la personne, en secondes. |
| persons.occurrences.position | JSONObject | Les coordonnées du visage. |
| persons.occurrences.position.leftTop | int[] | Les coordonnées x et y du coin supérieur gauche du cadre englobant du visage. |
| persons.occurrences.position.rightBottom | int[] | Les coordonnées x et y du coin inférieur droit du cadre englobant du visage. |
| persons.occurrences.timestamp | double | L'horodatage, en secondes, correspondant aux coordonnées du visage. |
| persons.occurrences.scene | String | Le type de plan. Les valeurs possibles sont : closeUp (gros plan), medium-closeUp (plan rapproché), medium (plan moyen) et medium-long (plan moyen-long). |
| tags | JSONArray | Un tableau d'objets représentant les étiquettes détectées, telles que les objets et les scènes. Voir le tableau ci-dessous pour des exemples. |
| tags.mainTagName | String | L'étiquette principale. |
| tags.subTagName | String | La sous-étiquette. |
| tags.ratio | double | Le ratio d'apparition de l'étiquette. La valeur est comprise entre 0 et 1. |
| tags.occurrences | JSONArray | Un tableau d'objets, chacun détaillant une apparition de l'étiquette. |
| tags.occurrences.score | double | Le score de confiance pour l'étiquette. |
| tags.occurrences.from | double | L'heure de début de l'apparition, en secondes. |
| tags.occurrences.to | double | L'heure de fin de l'apparition, en secondes. |
| classifications | JSONArray | Un tableau d'objets, chacun représentant une classification vidéo. |
| classifications.score | double | Le score de confiance pour la classification. |
| classifications.category1 | String | La catégorie de niveau 1, telle que Lifestyle, Anime ou Automotive. |
| classifications.category2 | String | La catégorie de niveau 2, une sous-catégorie de la catégorie de niveau 1. Par exemple, la catégorie Lifestyle inclut des sous-catégories comme Health ou Home. |
Étiquettes vidéo : exemples.
| Étiquette | Exemples |
| program | "Where Are We Going, Dad?", "Top Funny Comedian" |
| character | médecin, infirmière, enseignant |
| object | piano, tasse, table, œufs brouillés aux tomates, voiture, cosmétiques |
| logo | CCTV-1, CCTV-2, Youku, Dragon TV |
| action | danser, embrasser, serrer dans les bras, se réunir, chanter, passer un appel téléphonique, faire du cheval, se battre |
| location | Place Tian'anmen, Statue de la Liberté, Grand Bouddha de Leshan, Chine, États-Unis |
| scene | chambre, station de métro, rizières en terrasses, plage, désert |
Structure de données ImageLabel
| Paramètre | Type | Description |
| persons | JSONArray | Un tableau d'objets, chacun représentant une personne détectée. |
| persons.name | String | Le nom de la personne reconnue. |
| persons.category | String | La catégorie de la personne. Les valeurs valides sont celebrity, politician et sensitive. |
| persons.score | double | Le score de confiance pour la personne détectée. |
| persons.position | JSONObject | Les coordonnées du visage. |
| persons.position.leftTop | int[] | Les coordonnées x et y du coin supérieur gauche du cadre englobant. |
| persons.position.rightBottom | int[] | Les coordonnées x et y du coin inférieur droit du cadre englobant. |
| persons.scene | String | Le plan de la caméra. Les valeurs valides incluent : closeUp (gros plan), medium-closeUp (plan rapproché), medium (plan moyen) et medium-long (plan moyen-long). |
| tags | JSONArray | Étiquettes pour les objets et scènes détectés. Pour plus d'informations, consultez les exemples dans le tableau ci-dessous. |
| tags.mainTagName | String | L'étiquette principale. |
| tags.subTagName | String | La sous-étiquette. |
| tags.score | double | Le score de confiance pour l'étiquette. |
Exemples d'étiquettes d'image.
| Étiquette principale | Sous-étiquette |
| character | par ex., médecin, infirmière, enseignant |
| location | par ex., Place Tian'anmen, Statue de la Liberté, Grand Bouddha de Leshan, Chine, États-Unis |
| action | par ex., parler |
| logo | par ex., CCTV1, CCTV2, Youku, Dragon TV |
| action | par ex., danser, embrasser, serrer dans les bras, se réunir, chanter, passer un appel téléphonique, faire du cheval, se battre |
| object | par ex., piano, tasse, table, œufs brouillés aux tomates, voiture, cosmétiques |
| scene | par ex., chambre, station de métro, rizières en terrasses, plage, désert |
Structure de données TextLabel (Source : ASR et OCR)
| Paramètre | Type | Description |
| tags | JSONArray | Une liste d'étiquettes pour la ressource. |
| tags.name | String | La clé de l'étiquette. |
| tags.value | String | La valeur de l'étiquette. Utilisez une virgule pour séparer plusieurs valeurs. |
Exemples d'étiquettes d'image.
| Paramètre | Valeur |
| region | Exemples : Place Tian'anmen, Statue de la Liberté, Grand Bouddha de Leshan, Chine, États-Unis |
| organization | Exemples : Association chinoise pour la conservation de la faune sauvage, China Media Group |
| logo | Exemples : Nike, Li-Ning |
| keyword | Exemple : force centrale |
Structure de données CPVLabel
-
cates : catégories hiérarchiques (par ex., niveau 1, niveau 2 et niveau 3).
-
entities : attributs de catégorie (enrichis avec les informations du graphe de connaissances).
-
hotwords : mots-clés populaires (termes reflétant l'intérêt de l'utilisateur).
-
freeTags : étiquettes libres (mots-clés définis par l'utilisateur).
| Paramètre | Type | Valeur d'exemple | Description |
| type | String | hmi | Le type de résultat. Valeurs valides : hmi (résultat d'interaction homme-machine) et autp (résultat d'étiquetage automatisé). |
| cates | JSONArray | - | Les résultats de classification des catégories. |
| cates.labelLevel1 | String | Travel | L'étiquette de niveau 1. |
| cates.labelLevel2 | String | Travel Scenery | L'étiquette de niveau 2. |
| cates.label | String | "" | Le nom de l'étiquette. L'algorithme peut renvoyer une chaîne vide. |
| cates.appearanceProbability | double | 0.96 | La probabilité d'apparition. |
| cates.detailInfo | JSONArray | - | Informations détaillées sur la catégorie. |
| cates.detailInfo.score | double | 0.9 | Le score de confiance. |
| cates.detailInfo.startTime | double | 0.021 | L'heure de début. |
| cates.detailInfo.endTime | double | 29.021 | L'heure de fin. |
| entities | JSONArray | - | Entités détectées. |
| entities.labelLevel1 | String | Region | L'étiquette de niveau 1. |
| entities.labelLevel2 | String | Landmark | L'étiquette de niveau 2. |
| entities.label | String | Huangguoshu Waterfall | Le nom de l'étiquette. |
| entities.appearanceProbability | double | 0.067 | La probabilité d'apparition. |
| entities.knowledgeInfo | String | {"name": "黄果树瀑布", "nameEn": "Huangguoshu Waterfall", "description": "亚洲四大瀑布之一"} | Informations provenant du graphe de connaissances. Pour une liste complète des champs, reportez-vous aux tableaux des types de graphes de connaissances suivants : IP de cinéma et de télévision, musique, personne, point de repère et objet. |
| entities.detailInfo | JSONArray | - | Informations détaillées sur l'entité. |
| entities.detailInfo.score | double | 0.33292606472969055 | Le score de confiance. |
| entities.detailInfo.startTime | double | 6.021 | L'heure de début. |
| entities.detailInfo.endTime | double | 8.021 | L'heure de fin. |
| entities.detailInfo.trackData | JSONArray | - | Les informations structurées de l'étiquette d'entité. |
| entities.detailInfo.trackData.score | double | 0.32 | Le score de confiance. |
| entities.detailInfo.trackData.bbox | integer[] | 23,43,45,67 | Les coordonnées du cadre englobant. |
| entities.detailInfo.trackData.timestamp | double | 7.9 | L'horodatage. |
| hotwords | JSONArray | - | Mots-clés populaires détectés. |
| hotwords.labelLevel1 | String | keyword | L'étiquette de niveau 1. |
| hotwords.labelLevel1 | String | keyword | L'étiquette de niveau 1. |
| hotwords.labelLevel2 | String | "" | L'étiquette de niveau 2. |
| hotwords.label | String | 中国气象局 | Le contenu du mot-clé populaire. |
| hotwords.appearanceProbability | double | 0.96 | La probabilité d'apparition. |
| hotwords.detailInfo | JSONArray | Informations détaillées sur le mot-clé populaire. | |
| hotwords.detailInfo.score | double | 1.0 | Le score de confiance. |
| hotwords.detailInfo.startTime | double | 0.021 | L'heure de début. |
| hotwords.detailInfo.endTime | double | 29.021 | L'heure de fin. |
| freeTags | JSONArray | Les étiquettes libres. | |
| freeTags.labelLevel1 | String | keyword | L'étiquette de niveau 1. |
| freeTags.labelLevel2 | String | "" | L'étiquette de niveau 2. |
| freeTags.label | String | 中央气象台 | Le contenu de l'étiquette. |
| freeTags.appearanceProbability | double | 0.96 | La probabilité d'apparition. |
| freeTags.detailInfo | JSONArray | Informations détaillées sur l'étiquette libre. | |
| freeTags.detailInfo.score | double | 0.9 | Le score de confiance. |
| freeTags.detailInfo.startTime | double | 0.021 | L'heure de début. |
| freeTags.detailInfo.endTime | double | 29.021 | L'heure de fin. |
Résultat ASR
| Paramètre | Type | Description |
| details | JSONArray | Résultats détaillés de la tâche. |
| details.from | double | Horodatage de début du segment de parole, en secondes. |
| details.to | double | Horodatage de fin du segment de parole, en secondes. |
| details.content | String | Texte transcrit du segment de parole. |
Résultats OCR
| Paramètre | Type | Description |
| details | JSONArray | Un tableau d'objets contenant les détails de la tâche. |
| details.timestamp | double | L'horodatage, en secondes. |
| details.info | JSONArray | Un tableau d'objets, chacun contenant les informations reconnues pour l'horodatage correspondant. |
| details.info.score | double | Le score de confiance. |
| details.info.position | JSONObject | Les coordonnées du texte. |
| details.info.position.leftTop | int[] | Les coordonnées du coin supérieur gauche. |
| details.info.position.rightBottom | int[] | Les coordonnées du coin inférieur droit. |
| details.info.content | String | Le contenu du texte reconnu. |
Résultats d'annotation des métadonnées
Si vous n'utilisez pas l'annotation humaine et que vous spécifiez le paramètre needMetaData lors de la soumission d'une tâche avec SubmitSmarttagJob , QuerySmarttagJob renverra le title original que vous avez saisi.
| Paramètre | Type | Description |
| title | String | Le titre. |
Résultats d'extraction des sous-titres
| Paramètre | Type | Description |
| details | JSONArray | Résultats détaillés de la tâche. |
| details.allResultUrl | String | URL pour tous les résultats de sous-titres. L'URL est valide pendant six mois après la fin de la tâche. |
| details.chResultUrl | String | URL pour les résultats de sous-titres en chinois. L'URL est valide pendant six mois après la fin de la tâche. |
| details.engResultUrl | String | URL pour les résultats de sous-titres en anglais. L'URL est valide pendant six mois après la fin de la tâche. |
L'URL du résultat des sous-titres renvoie le contenu au format suivant : numéro de séquence + plage de temps + contenu du sous-titre (un sous-titre par ligne).
Résultats NLP
| Paramètre | Type | Description |
| transcription | object | La sortie de la conversion parole-texte. |
| autoChapters | object | Les chapitres générés automatiquement. |
| summarization | object | Le résumé généré par le grand modèle. |
| meetingAssistance | object | Le compte-rendu de réunion intelligent. |
| translation | object | Le texte traduit. |
Transcription
| Paramètre | Type | Description |
| transcription | object | Le résultat de la transcription de la parole. |
| transcription.paragraphs | list[] | Une liste de paragraphes dans la transcription de la parole. |
| transcription.paragraphs[i].paragraphId | string | L'identifiant au niveau du paragraphe. |
| transcription.paragraphs[i].speakerId | string | L'identifiant du locuteur. |
| transcription.paragraphs[i].words | list[] | Une liste de mots dans le paragraphe. |
| transcription.paragraphs[i].words[i].id | int | Le numéro de séquence du mot. Ce champ peut généralement être ignoré. |
| transcription.paragraphs[i].words[i].sentenceId | int | L'identifiant de la phrase. Les mots avec le même sentenceId forment une phrase. |
| transcription.paragraphs[i].words[i].start | long | L'heure de début du mot, en millisecondes, par rapport au début de l'audio. |
| transcription.paragraphs[i].words[i].end | long | L'heure de fin du mot, en millisecondes, par rapport au début de l'audio. |
| transcription.paragraphs[i].words[i].text | string | Le texte du mot. |
Résumé : résumé du texte intégral, résumé par locuteur et résumé des questions
| Paramètre | Type | Description |
| summarization | object | L'objet de résultat de résumé, qui peut contenir des résultats pour plusieurs types de résumé. |
| summarization.paragraphSummary | string | Le résultat du résumé de paragraphe. |
| summarization.conversationalSummary | list[] | Une liste de résultats de résumé conversationnel. |
| summarization.conversationalSummary[i].speakerId | string | L'identifiant du locuteur. |
| summarization.conversationalSummary[i].speakerName | string | Le nom du locuteur. |
| summarization.conversationalSummary[i].summary | string | Le résumé pour le locuteur. |
| summarization.questionsAnsweringSummary | list[] | Une liste de résultats de résumé de questions-réponses. |
| summarization.questionsAnsweringSummary[i].question | string | La question extraite de la transcription de la parole. |
| summarization.questionsAnsweringSummary[i].sentenceIdsOfQuestion | list[] | Identifiants des phrases de la transcription de la parole originale qui forment la question. |
| summarization.questionsAnsweringSummary[i].answer | string | La réponse à la question. |
| summarization.questionsAnsweringSummary[i].sentenceIdsOfAnswer | list[] | Les identifiants des phrases de la transcription de la parole originale qui sont résumées dans la réponse. |
| summarization.mindMapSummary | list[object] | Une liste de résultats de résumé de carte mentale, qui peut inclure des résumés de sujets et leurs relations. |
| summarization.mindMapSummary[i].title | string | Le titre de la carte mentale. |
| summarization.mindMapSummary[i].topic | list[object] | Une liste des sujets principaux, chacun avec ses sous-sujets respectifs. |
| summarization.mindMapSummary[i].topic[i].title | string | Le titre du sujet. |
| summarization.mindMapSummary[i].topic[i].topic | list[object] | Une liste de sous-sujets pour le sujet actuel, qui peut être vide. |
Traduction du texte intégral
| Paramètre | Type | Description |
| translation | object | L'objet de traduction. |
| translation.paragraphs | list[] | Une liste de paragraphes traduits, correspondant au résultat de la reconnaissance vocale. |
| translation.paragraphs.paragraphId | string | L'identifiant du paragraphe, qui correspond au ParagraphId du résultat de la reconnaissance vocale. |
| translation.paragraphs.sentences | list[] | Les phrases qui composent le paragraphe. |
| translation.paragraphs.sentences[i].sentenceId | long | L'identifiant unique de la phrase. |
| translation.paragraphs.sentences[i].start | long | L'heure de début de la phrase en millisecondes, par rapport au début de l'audio. |
| translation.paragraphs.sentences[i].end | long | L'heure de fin de la phrase en millisecondes, par rapport au début de l'audio. |
| translation.paragraphs.sentences[i].text | string | Le texte traduit de la phrase. |
autoChapters (reconnaissance de chapitres)
| Paramètre | Type | Description |
| autoChapters | list[] | Une liste d'objets d'aperçu de chapitre. |
| autoChapters[i].id | int | Identifiant du chapitre. |
| autoChapters[i].start | long | L'heure de début du chapitre, sous forme d'horodatage relatif en millisecondes à partir du début de l'audio. |
| autoChapters[i].end | long | L'heure de fin du chapitre, sous forme d'horodatage relatif en millisecondes à partir du début de l'audio. |
| autoChapters[i].headline | string | Titre du chapitre. |
| autoChapters[i].summary | string | Résumé du chapitre. |
meetingAssistance (résumé, mot-clé, phrase clé et extraction d'éléments d'action)
| Paramètre | Type | Description |
| meetingAssistance | object | L'objet de résultats de compte-rendu intelligent, qui peut contenir zéro ou plusieurs résultats de différents types. |
| meetingAssistance.keywords | list[] | Les résultats d'extraction de mots-clés. |
| meetingAssistance.keySentences | list[] | Les résultats d'extraction de phrases clés, également appelés contenu clé. |
| meetingAssistance.keySentences[i].id | long | L'identifiant de la phrase clé. |
| meetingAssistance.keySentences[i].sentenceId | long | L'identifiant de la phrase correspondante dans la transcription ASR originale. |
| meetingAssistance.keySentences[i].start | long | L'heure de début par rapport au début de l'audio, en millisecondes. |
| meetingAssistance.keySentences[i].end | long | L'heure de fin par rapport au début de l'audio, en millisecondes. |
| meetingAssistance.keySentences[i].text | string | Le texte de la phrase clé. |
| meetingAssistance.actions | list[] | Une liste d'éléments d'action. |
| meetingAssistance.actions[i].id | long | L'identifiant de l'élément d'action. |
| meetingAssistance.actions[i].sentenceId | long | L'identifiant de la phrase correspondante dans la transcription ASR originale. |
| meetingAssistance.actions[i].start | long | L'heure de début par rapport au début de l'audio, en millisecondes. |
| meetingAssistance.actions[i].end | long | L'heure de fin par rapport au début de l'audio, en millisecondes. |
| meetingAssistance.actions[i].text | string | Le texte de l'élément d'action. |
| meetingAssistance.classifications | object | Les résultats de classification de scène. Actuellement, seuls trois types de scènes sont pris en charge. |
| meetingAssistance.classifications.interview | float | Le score de confiance pour la scène d'entretien. |
| meetingAssistance.classifications.lecture | float | Le score de confiance pour la scène de cours magistral. |
| meetingAssistance.classifications.meeting | float | Le score de confiance pour la scène de réunion. |
Exemples
JSON format
{
"JobStatus": "Success",
"RequestId": "******11-DB8D-4A9A-875B-275798******",
"UserData": "{\"userId\":\"123432412831\"}",
"Results": {
"Result": [
{
"Type": "Meta",
"Data": "{\"title\":\"example-title-****\"}\t\n"
}
]
},
"Usages": {
"Usage": [
{
"Type": "",
"Quota": 0
}
]
}
}
Codes d'erreur
Consultez Codes d'erreur pour la liste complète.
Notes de version
Consultez Notes de version pour la liste complète.