Consulta uma tarefa de smart tag.
Experimente agora
Testar
Autorização RAM
|
Ação |
Nível de acesso |
Tipo de recurso |
Chave de condição |
Ação dependente |
|
ice:QuerySmarttagJob |
get |
*All Resource
|
Nenhuma | Nenhuma |
Parâmetros da solicitação
|
Parâmetro |
Tipo |
Obrigatório |
Descrição |
Exemplo |
| JobId |
string |
Sim |
O ID da tarefa de smart tag. Você pode obter esse ID na resposta da chamada SubmitSmarttagJob. |
88c6ca184c0e47098a5b665e2**** |
| Params |
string |
Não |
Parâmetros de solicitação adicionais, formatados como uma string JSON. Por exemplo:
|
{"labelResultType":"auto"} |
Elementos de resposta
|
Elemento |
Tipo |
Descrição |
Exemplo |
|
object |
|||
| JobStatus |
string |
O status da tarefa. Valores válidos:
|
Success |
| RequestId |
string |
O ID da solicitação. |
******11-DB8D-4A9A-875B-275798****** |
| UserData |
string |
Os dados personalizados transmitidos por meio do callback do MNS. Para obter detalhes sobre o formato da mensagem, consulte as definições de formato de mensagem de callback abaixo. |
{"userId":"123432412831"} |
| Results |
object |
||
| Result |
array<object> |
Uma matriz de objetos de resultado de análise. |
|
|
object |
|||
| Type |
string |
The type of the analysis result.
|
Meta |
| Data |
string |
The analysis result data, formatted as a JSON string. The data structure depends on the |
{"title":"example-title-****"} |
| Usages |
object |
||
| Usage |
array<object> |
||
|
object |
|||
| Type |
string |
||
| Quota |
integer |
Formato da mensagem de callback Quando o status de execução de uma tarefa de smart tag é alterado, o MPS envia uma mensagem de callback para uma fila especificada por você usando a API UpdatePipeline do MPS. O corpo da mensagem é uma string JSON que contém os seguintes campos:
| Parâmetro | Tipo | Descrição |
| Type | string | Uma string fixa com o valor smarttag, indicando uma tarefa de smart tag. |
| JobId | string | O ID exclusivo da tarefa. |
| State | string | O estado atual da tarefa. Este valor corresponde ao JobStatus retornado pela operação QuerySmarttagJob. |
| State | string | O estado atual da tarefa. Este valor corresponde ao JobStatus retornado pela operação QuerySmarttagJob. |
| UserData | string | Os dados do usuário transmitidos para a operação SubmitSmarttagJob. |
| UserData | string | Os dados do usuário transmitidos para a operação SubmitSmarttagJob. |
Parâmetros de resultado
Estrutura de dados VideoLabel
| Parâmetro | Tipo | Descrição |
| persons | JSONArray | Uma matriz de objetos, cada um representando uma pessoa detectada. |
| persons.name | String | O nome da pessoa reconhecida. |
| persons.category | String | A categoria da pessoa. Os valores possíveis são: celebrity, politician, sensitive (pessoa sensível) e unknown (pessoa desconhecida). Para uma pessoa de uma biblioteca de pessoas personalizada, este campo contém o ID da biblioteca. |
| persons.ratio | double | A taxa de aparição da pessoa. O valor varia de 0 a 1. |
| persons.occurrences | JSONArray | Uma matriz de objetos, cada um detalhando uma ocorrência da pessoa. |
| persons.occurrences.score | double | A pontuação de confiança para o reconhecimento. |
| persons.occurrences.from | double | A hora de início da aparição da pessoa, em segundos. |
| persons.occurrences.to | double | A hora de término da aparição da pessoa, em segundos. |
| persons.occurrences.position | JSONObject | As coordenadas do rosto. |
| persons.occurrences.position.leftTop | int[] | As coordenadas x e y do canto superior esquerdo da caixa delimitadora do rosto. |
| persons.occurrences.position.rightBottom | int[] | As coordenadas x e y do canto inferior direito da caixa delimitadora do rosto. |
| persons.occurrences.timestamp | double | O carimbo de data/hora, em segundos, correspondente às coordenadas do rosto. |
| persons.occurrences.scene | String | O tipo de plano. Os valores possíveis são: closeUp (plano detalhe), medium-closeUp (plano médio detalhe), medium (plano médio) e medium-long (plano médio longo). |
| tags | JSONArray | Uma matriz de objetos que representam tags detectadas, como objetos e cenas. Consulte a tabela abaixo para ver exemplos. |
| tags.mainTagName | String | A tag principal. |
| tags.subTagName | String | A subtag. |
| tags.ratio | double | A taxa de aparição da tag. O valor varia de 0 a 1. |
| tags.occurrences | JSONArray | Uma matriz de objetos, cada um detalhando uma ocorrência da tag. |
| tags.occurrences.score | double | A pontuação de confiança para a tag. |
| tags.occurrences.from | double | A hora de início da ocorrência, em segundos. |
| tags.occurrences.to | double | A hora de término da ocorrência, em segundos. |
| classifications | JSONArray | Uma matriz de objetos, cada um representando uma classificação de vídeo. |
| classifications.score | double | A pontuação de confiança para a classificação. |
| classifications.category1 | String | A categoria de nível 1, como Lifestyle, Anime ou Automotive. |
| classifications.category2 | String | A categoria de nível 2, uma subcategoria da categoria de nível 1. Por exemplo, a categoria Lifestyle inclui subcategorias como Health ou Home. |
Tags de vídeo: exemplos.
| Tag | Exemplos |
| program | "Where Are We Going, Dad?", "Top Funny Comedian" |
| character | médico, enfermeiro, professor |
| object | piano, xícara, mesa, ovos mexidos com tomate, carro, cosméticos |
| logo | CCTV-1, CCTV-2, Youku, Dragon TV |
| action | dançando, beijando, abraçando, reunindo, cantando, fazendo uma ligação, andando a cavalo, lutando |
| location | Praça Tiananmen, Estátua da Liberdade, Buda Gigante de Leshan, China, Estados Unidos |
| scene | quarto, estação de metrô, campos em socalcos, praia, deserto |
Estrutura de dados ImageLabel
| Parâmetro | Tipo | Descrição |
| persons | JSONArray | Uma matriz de objetos, cada um representando uma pessoa detectada. |
| persons.name | String | O nome da pessoa reconhecida. |
| persons.category | String | A categoria da pessoa. Os valores válidos são celebrity, politician e sensitive. |
| persons.score | double | A pontuação de confiança para a pessoa detectada. |
| persons.position | JSONObject | As coordenadas do rosto. |
| persons.position.leftTop | int[] | As coordenadas x e y do canto superior esquerdo da caixa delimitadora. |
| persons.position.rightBottom | int[] | As coordenadas x e y do canto inferior direito da caixa delimitadora. |
| persons.scene | String | O plano da câmera. Os valores válidos incluem: closeUp (plano detalhe), medium-closeUp (plano médio detalhe), medium (plano médio) e medium-long (plano médio longo). |
| tags | JSONArray | Tags para objetos e cenas detectados. Para obter mais informações, consulte os exemplos na tabela abaixo. |
| tags.mainTagName | String | A tag principal. |
| tags.subTagName | String | A subtag. |
| tags.score | double | A pontuação de confiança para a tag. |
Exemplos de tags de imagem.
| Tag principal | Subtag |
| character | por exemplo, médico, enfermeiro, professor |
| location | por exemplo, Praça Tiananmen, Estátua da Liberdade, Buda Gigante de Leshan, China, Estados Unidos |
| action | por exemplo, falando |
| logo | por exemplo, CCTV1, CCTV2, Youku, Dragon TV |
| action | por exemplo, dançando, beijando, abraçando, reunindo, cantando, fazendo uma ligação, andando a cavalo, lutando |
| object | por exemplo, piano, xícara, mesa, ovos mexidos com tomate, carro, cosméticos |
| scene | por exemplo, quarto, estação de metrô, campos em socalcos, praia, deserto |
A estrutura de dados TextLabel (Fonte: ASR e OCR)
| Parâmetro | Tipo | Descrição |
| tags | JSONArray | Uma lista de tags para o recurso. |
| tags.name | String | A chave da tag. |
| tags.value | String | O valor da tag. Use uma vírgula para separar vários valores. |
Exemplos de tags de imagem.
| Parâmetro | Valor |
| region | Exemplos: Praça Tiananmen, Estátua da Liberdade, Buda Gigante de Leshan, China, Estados Unidos |
| organization | Exemplos: China Wildlife Conservation Association, China Media Group |
| logo | Exemplos: Nike, Li-Ning |
| keyword | Exemplo: core strength |
Estrutura de dados CPVLabel
-
cates: Categorias hierárquicas (por exemplo, nível 1, nível 2 e nível 3). -
entities: Atributos de categoria (enriquecidos com informações do grafo de conhecimento). -
hotwords: Palavras-chave populares (termos que refletem o interesse do usuário). -
freeTags: Tags de forma livre (palavras-chave definidas pelo usuário).
| Parâmetro | Tipo | Valor de exemplo | Descrição |
| type | String | hmi | O tipo de resultado. Valores válidos: hmi (resultado de interação humano-máquina) e autp (resultado de tag automatizada). |
| cates | JSONArray | - | Os resultados de classificação de categoria. |
| cates.labelLevel1 | String | Travel | O rótulo de nível 1. |
| cates.labelLevel2 | String | Travel Scenery | O rótulo de nível 2. |
| cates.label | String | "" | O nome do rótulo. O algoritmo pode retornar uma string vazia. |
| cates.appearanceProbability | double | 0.96 | A probabilidade de aparição. |
| cates.detailInfo | JSONArray | - | Informações detalhadas sobre a categoria. |
| cates.detailInfo.score | double | 0.9 | A pontuação de confiança. |
| cates.detailInfo.startTime | double | 0.021 | A hora de início. |
| cates.detailInfo.endTime | double | 29.021 | A hora de término. |
| entities | JSONArray | - | Entidades detectadas. |
| entities.labelLevel1 | String | Region | O rótulo de nível 1. |
| entities.labelLevel2 | String | Landmark | O rótulo de nível 2. |
| entities.label | String | Huangguoshu Waterfall | O nome do rótulo. |
| entities.appearanceProbability | double | 0.067 | A probabilidade de aparição. |
| entities.knowledgeInfo | String | {"name": "黄果树瀑布", "nameEn": "Huangguoshu Waterfall", "description": "亚洲四大瀑布之一"} | Informações do grafo de conhecimento. Para obter uma lista completa de campos, consulte as tabelas para os seguintes tipos de grafo de conhecimento: IP de cinema e televisão, música, pessoa, ponto de referência e objeto. |
| entities.detailInfo | JSONArray | - | Informações detalhadas sobre a entidade. |
| entities.detailInfo.score | double | 0.33292606472969055 | A pontuação de confiança. |
| entities.detailInfo.startTime | double | 6.021 | A hora de início. |
| entities.detailInfo.endTime | double | 8.021 | A hora de término. |
| entities.detailInfo.trackData | JSONArray | - | As informações estruturadas do rótulo da entidade. |
| entities.detailInfo.trackData.score | double | 0.32 | A pontuação de confiança. |
| entities.detailInfo.trackData.bbox | integer[] | 23,43,45,67 | As coordenadas da caixa delimitadora. |
| entities.detailInfo.trackData.timestamp | double | 7.9 | O carimbo de data/hora. |
| hotwords | JSONArray | - | Palavras-chave populares detectadas. |
| hotwords.labelLevel1 | String | keyword | O rótulo de nível 1. |
| hotwords.labelLevel1 | String | keyword | O rótulo de nível 1. |
| hotwords.labelLevel2 | String | "" | O rótulo de nível 2. |
| hotwords.label | String | 中国气象局 | O conteúdo da palavra-chave popular. |
| hotwords.appearanceProbability | double | 0.96 | A probabilidade de aparição. |
| hotwords.detailInfo | JSONArray | Informações detalhadas sobre a palavra-chave popular. | |
| hotwords.detailInfo.score | double | 1.0 | A pontuação de confiança. |
| hotwords.detailInfo.startTime | double | 0.021 | A hora de início. |
| hotwords.detailInfo.endTime | double | 29.021 | A hora de término. |
| freeTags | JSONArray | As tags de forma livre. | |
| freeTags.labelLevel1 | String | keyword | O rótulo de nível 1. |
| freeTags.labelLevel2 | String | "" | O rótulo de nível 2. |
| freeTags.label | String | 中央气象台 | O conteúdo da tag. |
| freeTags.appearanceProbability | double | 0.96 | A probabilidade de aparição. |
| freeTags.detailInfo | JSONArray | Informações detalhadas sobre a tag de forma livre. | |
| freeTags.detailInfo.score | double | 0.9 | A pontuação de confiança. |
| freeTags.detailInfo.startTime | double | 0.021 | A hora de início. |
| freeTags.detailInfo.endTime | double | 29.021 | A hora de término. |
Resultado do ASR
| Parâmetro | Tipo | Descrição |
| details | JSONArray | Resultados detalhados da tarefa. |
| details.from | double | Carimbo de data/hora de início do segmento de fala, em segundos. |
| details.to | double | Carimbo de data/hora de término do segmento de fala, em segundos. |
| details.content | String | Texto transcrito do segmento de fala. |
Resultados do OCR
| Parâmetro | Tipo | Descrição |
| details | JSONArray | Uma matriz de objetos contendo os detalhes da tarefa. |
| details.timestamp | double | O carimbo de data/hora, em segundos. |
| details.info | JSONArray | Uma matriz de objetos, cada um contendo informações reconhecidas para o carimbo de data/hora correspondente. |
| details.info.score | double | A pontuação de confiança. |
| details.info.position | JSONObject | As coordenadas do texto. |
| details.info.position.leftTop | int[] | As coordenadas do canto superior esquerdo. |
| details.info.position.rightBottom | int[] | As coordenadas do canto inferior direito. |
| details.info.content | String | O conteúdo de texto reconhecido. |
Resultados da anotação de metadados
Se você não usar anotação humana e especificar o parâmetro needMetaData ao enviar uma tarefa com SubmitSmarttagJob , o QuerySmarttagJob retornará o title original que você inseriu.
| Parâmetro | Tipo | Descrição |
| title | String | O título. |
Resultados da extração de legendas
| Parâmetro | Tipo | Descrição |
| details | JSONArray | Resultados detalhados da tarefa. |
| details.allResultUrl | String | URL para todos os resultados de legendas. A URL é válida por seis meses após a conclusão da tarefa. |
| details.chResultUrl | String | URL para os resultados de legendas em chinês. A URL é válida por seis meses após a conclusão da tarefa. |
| details.engResultUrl | String | URL para os resultados de legendas em inglês. A URL é válida por seis meses após a conclusão da tarefa. |
A URL do resultado da legenda retorna o conteúdo no seguinte formato: número de sequência + intervalo de tempo + conteúdo da legenda (uma legenda por linha).
Resultados do NLP
| Parâmetro | Tipo | Descrição |
| transcription | object | A saída de fala para texto. |
| autoChapters | object | Os capítulos gerados automaticamente. |
| summarization | object | O resumo gerado pelo modelo grande. |
| meetingAssistance | object | A ata de reunião inteligente. |
| translation | object | O texto traduzido. |
Transcrição
| Parâmetro | Tipo | Descrição |
| transcription | object | O resultado da transcrição de fala. |
| transcription.paragraphs | list[] | Uma lista de parágrafos na transcrição de fala. |
| transcription.paragraphs[i].paragraphId | string | O ID no nível do parágrafo. |
| transcription.paragraphs[i].speakerId | string | O ID do falante. |
| transcription.paragraphs[i].words | list[] | Uma lista de palavras no parágrafo. |
| transcription.paragraphs[i].words[i].id | int | O número de sequência da palavra. Este campo geralmente pode ser ignorado. |
| transcription.paragraphs[i].words[i].sentenceId | int | O ID da frase. Palavras com o mesmo sentenceId formam uma frase. |
| transcription.paragraphs[i].words[i].start | long | A hora de início da palavra, em milissegundos, em relação ao início do áudio. |
| transcription.paragraphs[i].words[i].end | long | A hora de término da palavra, em milissegundos, em relação ao início do áudio. |
| transcription.paragraphs[i].words[i].text | string | O texto da palavra. |
Resumo: resumo de texto completo, resumo do falante e resumo de perguntas
| Parâmetro | Tipo | Descrição |
| summarization | object | O objeto de resultado do resumo, que pode conter resultados para vários tipos de resumo. |
| summarization.paragraphSummary | string | O resultado do resumo do parágrafo. |
| summarization.conversationalSummary | list[] | Uma lista de resultados de resumo conversacional. |
| summarization.conversationalSummary[i].speakerId | string | O ID do falante. |
| summarization.conversationalSummary[i].speakerName | string | O nome do falante. |
| summarization.conversationalSummary[i].summary | string | O resumo para o falante. |
| summarization.questionsAnsweringSummary | list[] | Uma lista de resultados de resumo de perguntas e respostas. |
| summarization.questionsAnsweringSummary[i].question | string | A pergunta extraída da transcrição de fala. |
| summarization.questionsAnsweringSummary[i].sentenceIdsOfQuestion | list[] | IDs de frases da transcrição de fala original que formam a pergunta. |
| summarization.questionsAnsweringSummary[i].answer | string | A resposta para a pergunta. |
| summarization.questionsAnsweringSummary[i].sentenceIdsOfAnswer | list[] | Os IDs de frases da transcrição de fala original que são resumidas na resposta. |
| summarization.mindMapSummary | list[object] | Uma lista de resultados de resumo de mapa mental, que podem incluir resumos de tópicos e seus relacionamentos. |
| summarization.mindMapSummary[i].title | string | O título do mapa mental. |
| summarization.mindMapSummary[i].topic | list[object] | Uma lista dos tópicos principais, cada um com seus respectivos subtópicos. |
| summarization.mindMapSummary[i].topic[i].title | string | O título do tópico. |
| summarization.mindMapSummary[i].topic[i].topic | list[object] | Uma lista de subtópicos para o tópico atual, que pode estar vazia. |
Tradução de texto completo
| Parâmetro | Tipo | Descrição |
| translation | object | O objeto de tradução. |
| translation.paragraphs | list[] | Uma lista de parágrafos traduzidos, correspondente ao resultado do reconhecimento de fala. |
| translation.paragraphs.paragraphId | string | O ID do parágrafo, que corresponde ao ParagraphId do resultado do reconhecimento de fala. |
| translation.paragraphs.sentences | list[] | As frases que compõem o parágrafo. |
| translation.paragraphs.sentences[i].sentenceId | long | O ID exclusivo da frase. |
| translation.paragraphs.sentences[i].start | long | A hora de início da frase em milissegundos, em relação ao início do áudio. |
| translation.paragraphs.sentences[i].end | long | A hora de término da frase em milissegundos, em relação ao início do áudio. |
| translation.paragraphs.sentences[i].text | string | O texto traduzido da frase. |
autoChapters (reconhecimento de capítulos)
| Parâmetro | Tipo | Descrição |
| autoChapters | list[] | Uma lista de objetos de visão geral de capítulos. |
| autoChapters[i].id | int | ID do capítulo. |
| autoChapters[i].start | long | A hora de início do capítulo, como um carimbo de data/hora relativo em milissegundos a partir do início do áudio. |
| autoChapters[i].end | long | A hora de término do capítulo, como um carimbo de data/hora relativo em milissegundos a partir do início do áudio. |
| autoChapters[i].headline | string | Título do capítulo. |
| autoChapters[i].summary | string | Resumo do capítulo. |
meetingAssistance (extração de resumo, palavra-chave, frase-chave e item de ação)
| Parâmetro | Tipo | Descrição |
| meetingAssistance | object | O objeto de resultados de atas inteligentes, que pode conter zero ou mais resultados de vários tipos. |
| meetingAssistance.keywords | list[] | Os resultados da extração de palavras-chave. |
| meetingAssistance.keySentences | list[] | Os resultados da extração de frases-chave, também conhecidos como conteúdo-chave. |
| meetingAssistance.keySentences[i].id | long | O ID da frase-chave. |
| meetingAssistance.keySentences[i].sentenceId | long | O ID da frase correspondente na transcrição original do ASR. |
| meetingAssistance.keySentences[i].start | long | A hora de início em relação ao início do áudio, em milissegundos. |
| meetingAssistance.keySentences[i].end | long | A hora de término em relação ao início do áudio, em milissegundos. |
| meetingAssistance.keySentences[i].text | string | O texto da frase-chave. |
| meetingAssistance.actions | list[] | Uma lista de itens de ação. |
| meetingAssistance.actions[i].id | long | O ID do item de ação. |
| meetingAssistance.actions[i].sentenceId | long | O ID da frase correspondente na transcrição original do ASR. |
| meetingAssistance.actions[i].start | long | A hora de início em relação ao início do áudio, em milissegundos. |
| meetingAssistance.actions[i].end | long | A hora de término em relação ao início do áudio, em milissegundos. |
| meetingAssistance.actions[i].text | string | O texto do item de ação. |
| meetingAssistance.classifications | object | Os resultados da classificação de cena. Atualmente, apenas três tipos de cena são suportados. |
| meetingAssistance.classifications.interview | float | A pontuação de confiança para a cena de entrevista. |
| meetingAssistance.classifications.lecture | float | A pontuação de confiança para a cena de palestra. |
| meetingAssistance.classifications.meeting | float | A pontuação de confiança para a cena de reunião. |
Exemplos
Resposta de sucesso
JSON formato
{
"JobStatus": "Success",
"RequestId": "******11-DB8D-4A9A-875B-275798******",
"UserData": "{\"userId\":\"123432412831\"}",
"Results": {
"Result": [
{
"Type": "Meta",
"Data": "{\"title\":\"example-title-****\"}\t\n"
}
]
},
"Usages": {
"Usage": [
{
"Type": "",
"Quota": 0
}
]
}
}
Códigos de erro
Consulte Códigos de Erro para uma lista completa.
Notas de versão
Consulte Notas de Versão para uma lista completa.