Todos os produtos
Search
Central de documentação

AI Guardrails:Video file moderation enhanced 2.0 API

Última atualização: Jul 07, 2026

A moderação de conteúdo 2.0 ajuda você a detectar conteúdos arriscados ou não conformes em arquivos de vídeo. Este artigo mostra como usar a API para moderação de conteúdo e detecção de marcadores AIGC.

Integração

  1. Crie uma conta Alibaba Cloud. Cadastre-se agora. Siga as instruções na tela para concluir o registro.

  2. Ative o pagamento conforme o uso para o Content Moderation. Para mais detalhes, consulte Activate Service. A ativação é gratuita. O faturamento baseia-se no uso da API. Para mais informações, consulte Faturamento.

  3. Crie um AccessKey no RAM. Para obter instruções, consulte Criar um AccessKey. Se você utilizar o AccessKey de um usuário RAM (subconta), conceda a permissão AliyunYundunGreenWebFullAccess a esse usuário RAM usando sua conta Alibaba Cloud (conta principal). Para obter instruções, consulte Autorização do RAM.

  4. Recomendamos o uso de um SDK para chamar as APIs. Para mais informações, consulte SDK e guia de integração do Video Moderation-Enhanced 2.0.

  5. O serviço de moderação de arquivos de vídeo inclui as seguintes 2 APIs:

    • VideoModeration: Envia uma tarefa de moderação de arquivo de vídeo.

    • VideoModerationResult: Obtém o resultado da moderação do arquivo de vídeo.

Enviar uma tarefa de moderação

API

  • Operação da API: VideoModeration. Esta operação suporta apenas detecção assíncrona de arquivos de vídeo.

  • Regiões e endpoints suportados:

    Região

    Endpoint público

    Endpoint privado

    Serviços

    Singapura

    green-cip.ap-southeast-1.aliyuncs.com

    green-cip-vpc.ap-southeast-1.aliyuncs.com

    videoDetection_global, videoDetectionByVL_global

    EUA (Virgínia)

    green-cip.us-east-1.aliyuncs.com

    green-cip-vpc.us-east-1.aliyuncs.com

    videoDetection_global

    EUA (Vale do Silício)

    green-cip.us-west-1.aliyuncs.com

    Não disponível

    Alemanha (Frankfurt)

    green-cip.eu-central-1.aliyuncs.com

    Não disponível

  • Faturamento:

    Esta é uma operação paga. O faturamento ocorre com base nas políticas de moderação de quadros de vídeo e áudio que você configurar. Para quadros de vídeo, é possível selecionar vários serviços. A taxa total corresponde ao número de quadros capturados multiplicado pelo preço unitário de cada serviço selecionado. Caso ative também a moderação de conteúdo de áudio, haverá uma cobrança adicional. Essa taxa é calculada multiplicando a duração do vídeo pelo preço unitário do recurso de moderação de áudio. Para mais informações sobre faturamento, consulte Faturamento.

  • Alvo da moderação: Este serviço suporta arquivos de vídeo.

  • Resposta: Tarefas de detecção assíncrona não retornam resultados em tempo real. É possível recuperar os resultados por meio de callbacks ou polling. Os resultados ficam retidos por no máximo 24 horas.

    • Recuperar resultados via callback: Ao enviar uma tarefa de detecção assíncrona, inclua o parâmetro callback na solicitação para receber os resultados automaticamente.

    • Recuperar resultados via polling: Ao enviar uma tarefa de detecção assíncrona, não inclua o parâmetro callback. Após o envio da tarefa, chame a API de consulta de resultados para obtê-los.

  • Requisitos de vídeo:

    • A URL do arquivo de vídeo deve usar o protocolo HTTP ou HTTPS.

    • O serviço suporta os seguintes formatos de arquivo de vídeo: AVI, FLV, MP4, MPG, ASF, WMV, MOV, WMA, RMVB, RM, FLASH, TS, M3U8, entre outros.

    • Limite de tamanho de vídeo: Por padrão, o tamanho máximo de um único arquivo de vídeo é de 500 MB. Se o seu arquivo exceder esse limite, utilize fragmentação. Alternativamente, entre em contato conosco para aumentar o limite de tamanho.

    • O tempo de moderação do vídeo depende da velocidade de download do arquivo. Para garantir um download estável e confiável, recomendamos armazenar seus arquivos de vídeo no Alibaba Cloud OSS.

  • Configuração de regras de moderação:

    • Antes de chamar esta operação pela primeira vez, configure as regras de moderação de vídeo no console do Content Moderation.

      Nota

      No console, você pode definir configurações como método de captura de quadros, frequência de captura, regras de moderação de quadros, regras de moderação de áudio e escopo dos resultados. Para obter instruções, consulte o Guia do Usuário do Console.

  • Por padrão, a API de revisão de vídeo 2.0 utiliza as seguintes configurações:

    Serviço

    Configuração padrão

    Detecção de arquivo de vídeo (Global) (videoDetection_global)

    • Intervalo de captura de quadros: 1 segundo

    • Serviço de detecção de quadros de vídeo: Detecção de linha de base geral (Global) (baselineCheck_global)

    • Detecção de áudio do vídeo: Ativada

    • Serviço de detecção de áudio do vídeo: Detecção de mídia de áudio e vídeo multilíngue (audio_multilingual_global)

    • Método de retorno de resultados: Retorna apenas resultados que indicam risco.

    Detecção de arquivo de vídeo (Edição Large Model, Global) (videoDetectionByVL_global)

    Nota

    Disponível apenas na região de Singapura. A simultaneidade é limitada a 10 tarefas.

    • Intervalo de captura de quadros: 1 segundo

    • Serviço de detecção de quadros de vídeo: Serviço de moderação de imagens com modelos grandes e pequenos híbridos (Global) (postImageCheckByVL_global)

    • Detecção de áudio do vídeo: Ativada

    • Serviço de detecção de áudio do vídeo: Detecção de mídia de áudio e vídeo multilíngue (audio_multilingual_global)

    • Método de retorno de resultados: Retorna apenas resultados que indicam risco.

Limites de taxa

Cada usuário tem um limite de 100 QPS e uma simultaneidade máxima de 50, o que permite processar até 50 tarefas ao mesmo tempo. Para aumentar esse limite, entre em contato com seu gerente de conta. Exceder esses limites aciona o controle de taxa, o que pode impactar seus negócios.

Depuração

Antes da integração, utilize a Alibaba Cloud OpenAPI para depurar a API VideoModeration. Nesse ambiente, revise os códigos de exemplo e as dependências do SDK para se familiarizar com o uso e os parâmetros da API.

Importante

O recurso de depuração online chama a API do Content Moderation usando sua conta, e essas chamadas contam como uso faturável.

Parâmetros da solicitação

Parâmetro

Tipo

Obrigatório

Valor de exemplo

Descrição

Service

String

Sim

videoDetection_global

Especifica o serviço de moderação de conteúdo. Valores válidos:

  • videoDetection_global: Detecção de arquivo de vídeo.

  • videoDetectionByVL_global: Detecção de arquivo de vídeo (versão large model).

ServiceParameters

String JSON

Sim

Parâmetros específicos do serviço, formatados como uma string JSON. Para mais detalhes, consulte Tabela 1 ServiceParameters.

Tabela 1. Parâmetros do serviço

Parâmetro

Tipo

Obrigatório

Valor de exemplo

Descrição

url

String

Sim. Forneça um vídeo de uma das três formas seguintes:

  • Para detectar conteúdo via URL de vídeo, especifique o parâmetro url.

  • Para detectar conteúdo usando um objeto OSS autorizado, especifique os parâmetros ossBucketName, ossObjectName e ossRegionId.

  • Faça upload de um arquivo de vídeo local. Este método não utiliza seu armazenamento OSS, e o arquivo fica armazenado por apenas 30 minutos. O SDK oferece funcionalidade para upload de vídeos locais. Para código de exemplo, consulte Guia de integração e SDK do Video Moderation Enhancement 2.0.

http://www.aliyundoc.com/a.flv

URL do vídeo a ser moderado. A URL deve ser acessível pela internet ou ser um endpoint interno do OSS na mesma região.

Nota

A URL não deve conter caracteres chineses nem exceder 2.048 caracteres. Envie apenas uma URL por solicitação.

ossBucketName

String

bucket_01

Nome do bucket OSS autorizado.

Nota

Para usar uma URL interna do OSS, conceda acesso primeiro usando sua conta Alibaba Cloud na página de Autorização de Acesso a Recursos da Nuvem.

ossObjectName

String

20240307/07/28/test.flv

Nome do arquivo no bucket OSS autorizado.

ossRegionId

String

cn-shanghai

Região onde o bucket OSS está localizado.

callback

String

Não

http://www.aliyundoc.com

URL para receber notificações de callback com os resultados da moderação. A URL deve suportar HTTP e HTTPS. Caso não especifique este parâmetro, será necessário consultar os resultados periodicamente.

Seu endpoint de callback deve suportar o método POST, dados codificados em UTF-8 e os parâmetros de formulário checksum e content.

O Content Moderation gera os valores de checksum e content conforme as regras abaixo e os envia ao seu endpoint de callback.

  • checksum: String gerada aplicando o algoritmo SHA-256 à concatenação de UID do usuário + seed + content. O UID do usuário é o ID da sua conta Alibaba Cloud, disponível no Console Alibaba Cloud. Para evitar adulterações, verifique o checksum recalculando a assinatura com o mesmo algoritmo ao receber a notificação de callback.

    Nota

    O UID deve pertencer à sua conta Alibaba Cloud, não a um usuário RAM.

  • content: Valor em formato de string JSON. Faça o parse para um objeto JSON. Para ver um exemplo do resultado de content, consulte a resposta de exemplo para consulta de resultados de detecção.

Nota

Quando seu endpoint de callback recebe um resultado do Content Moderation, ele deve retornar um código de status HTTP 200 para confirmar o recebimento. Qualquer outro código indica falha. Em caso de falha, o Content Moderation tenta reenviar o resultado até 16 vezes. Se todas as tentativas falharem, o serviço interrompe os reenvios. Recomendamos verificar o status do seu endpoint de callback.

seed

String

Não

abc****

String aleatória usada para assinar a solicitação de notificação de callback.

Esta string definida pelo usuário pode conter letras, dígitos e sublinhados (_), com comprimento máximo de 64 caracteres. Esse valor permite verificar se a notificação de callback se origina do serviço Content Moderation.

Nota

Este parâmetro é obrigatório se você especificar o parâmetro callback.

cryptType

String

Não

SHA256

Ao usar notificações de callback, este parâmetro define o algoritmo para assinar o payload do callback. O Content Moderation usa esse algoritmo para calcular uma assinatura da string (concatenação de UID do usuário + seed + content) e envia a assinatura para sua URL de callback. Valores válidos:

  • SHA256 (Padrão): Usa o algoritmo SHA-256.

  • SM3: Usa o algoritmo HMAC-SM3. O resultado é uma string hexadecimal em minúsculas.

    Por exemplo, o hash SM3 de abc é 66c7f0f462eeedd9d1f2d46bdc10e4e24167c4875cf2f7a2297da02b8f4ba8e0.

dataId

String

Não

videoId****

ID de dados correspondente ao objeto a ser moderado.

Este ID identifica exclusivamente seus dados comerciais. Pode conter letras maiúsculas e minúsculas, dígitos, sublinhados (_), hifens (-) e pontos (.), com limite de 128 caracteres.

offline

String

Não

false

Define se o modo de detecção offline será usado.

  • false (Padrão): modo de detecção em tempo real. Solicitações que excedem o limite de simultaneidade são rejeitadas.

  • true: modo de detecção offline. As tarefas entram em fila e não têm garantia de processamento em tempo real, mas a detecção começa dentro de 24 horas.

Importante

Este parâmetro é uma string. O modo de detecção offline é compatível nas regiões China (Pequim), China (Xangai) e China (Hangzhou).

referer

String

Não

www.aliyun.com

Cabeçalho de solicitação Referer, usado para proteção contra hotlink. Não deve exceder 256 caracteres.

infoType

String

Não

customImage,textInImage

Especifica os tipos de informações auxiliares a serem retornadas. Quando este parâmetro é definido, o resultado da moderação de cada quadro capturado inclui as informações auxiliares correspondentes. Valores válidos:

  • customImage: Informações de correspondência com biblioteca de imagens personalizadas.

  • textInImage: Texto detectado na imagem (resultado OCR).

  • publicFigure: Informações de correspondência com figuras públicas.

  • logoData: Informações de detecção de logotipos e marcas registradas.

  • vlContent: Resultados brutos da análise do large model.

É possível especificar vários valores separados por vírgulas. Por exemplo, customImage,textInImage retorna tanto as informações de correspondência com biblioteca de imagens personalizadas quanto o texto detectado na imagem.

Nota

Quando o Content Moderation envia um resultado de detecção para sua interface de callback no servidor, a entrega só é considerada bem-sucedida se sua interface retornar um código de status HTTP 200. Qualquer outro código é tratado como falha. Em caso de falha, o Content Moderation tenta entregar o resultado até 16 vezes. Se todas as 16 tentativas falharem, o serviço interrompe o envio. Nessa situação, verifique o status da sua interface de callback.

Valor de retorno

Parâmetro

Tipo

Valor de exemplo

Descrição

Code

Integer

200

Código de status. Para mais informações, consulte Descrição dos códigos.

Data

JSONObject

Objeto que contém os resultados da moderação.

TaskId

String

AAAAA-BBBBB

ID da tarefa de detecção.

DataId

String

dataId0307

ID dos dados.

Message

String

OK

Mensagem de resposta.

RequestId

String

ABCD1234-1234-1234-1234-123****

ID da solicitação.

Exemplo

Exemplo de solicitação

{
    "Service": "videoDetection_global",
    "ServiceParameters": {
        "url": "http://www.aliyundoc.com/a.flv",
        "dataId": "videoId****"
    }
}

Exemplo de resposta bem-sucedida

{
    "Message": "OK",
    "Code": 200,
    "Data": {
        "TaskId": "AAAAA-BBBBB",
        "DataId": "videoId****"
    },
    "RequestId": "ABCD1234-1234-1234-1234-123****"
}

Resultado da moderação de vídeo

API

  • Operação da API: VideoModerationResult. Recupera os resultados de uma tarefa de moderação de arquivo de vídeo.

  • Faturamento: Esta API é gratuita.

  • Tempo limite de consulta: Recomendamos aguardar 30 segundos após enviar uma tarefa de detecção assíncrona antes de consultar o resultado. Resultados não recuperados dentro de 24 horas são excluídos automaticamente.

Limites de taxa

Esta API tem limite de 100 QPS por usuário. Chamadas que excedem esse limite sofrem throttling, o que pode afetar seus negócios.

Depuração

Antes da integração, também é possível usar a Alibaba Cloud OpenAPI para depurar a API VideoModerationResult online. Revise os códigos de exemplo e as dependências do SDK para obter uma visão geral do uso e dos parâmetros.

Parâmetros da solicitação

Parâmetro

Tipo

Obrigatório

Exemplo

Descrição

Service

String

Sim

videoDetection_global

Tipo de serviço de moderação. Deve corresponder ao tipo especificado ao enviar a tarefa de moderação.

ServiceParameters

String JSON

Sim

Conjunto de parâmetros necessários para o serviço de moderação, em formato de string JSON. Para detalhes sobre cada campo, consulte Tabela 1 ServiceParameters.

Tabela 1: ServiceParameters

Parâmetro

Tipo

Obrigatório

Exemplo

Descrição

taskId

string

Sim

abcd****

ID da tarefa de detecção. Apenas um taskId pode ser especificado por solicitação.

Nota

Após enviar uma tarefa de detecção, a resposta contém o taskId.

Parâmetros de resposta

Parâmetro

Tipo

Valor de exemplo

Descrição

RequestId

String

ABCD1234-1234-1234-1234-123****

Identificador exclusivo da solicitação, gerado pela Alibaba Cloud. Use este ID para solucionar problemas e localizar falhas.

Data

Object

Resultado da moderação de conteúdo de vídeo. Para detalhes, consulte Tabela 2 Data.

Code

String

200

Código de status HTTP. Para detalhes, consulte Descrição dos códigos.

Message

String

OK

Mensagem de resposta.

Tabela 2. Data

Parâmetro

Tipo

Exemplo

Descrição

DataId

String

videoId****

ID de dados do objeto de detecção.

Nota

Se você especificar um ID de dados nos parâmetros da solicitação de detecção, este campo retorna o mesmo ID.

TaskId

String

AAAAA-BBBBB-2024-0307

ID da tarefa de detecção.

RiskLevel

String

high

Nível de risco combinado dos quadros e do áudio do vídeo. Os valores possíveis são:

  • high: alto risco

  • medium: risco médio

  • low: baixo risco

  • none: nenhum risco detectado

Nota

Trate conteúdos de alto risco diretamente. Para conteúdos de risco médio, sugerimos revisão manual. Enderece conteúdos de baixo risco apenas quando for necessária alta taxa de recall; caso contrário, trate-os como conteúdo sem risco detectado. Configure as pontuações de risco para quadros de vídeo no Console do Content Moderation.

FrameResult

JSONObject

Resultado da detecção de quadros de vídeo. Se a chamada for bem-sucedida (code=200), este campo contém uma estrutura. Para detalhes sobre a estrutura, consulte Tabela 3 FrameResult.

Nota

Em cenários de detecção de fluxo de vídeo, um code 280 indica que a detecção está em andamento, enquanto 200 indica conclusão. Durante a detecção, o resultado inclui todas as descobertas até o momento atual.

AudioResult

JSONObject

Resultado da detecção de áudio. Este campo contém uma estrutura. Para detalhes sobre a estrutura, consulte Tabela 13 audioResult.

Tabela 3: FrameResult

Parâmetro

Tipo

Valor

Descrição

FrameNum

Integer

200

Número total de quadros capturados do vídeo.

FrameSummarys

JSONArray

Resumo dos rótulos detectados nos quadros de vídeo. Consulte Tabela 4 FrameSummary para ver a estrutura.

RiskLevel

String

high

Nível de risco do vídeo, calculado com base em todos os seus quadros. Valores válidos:

  • high: Alto risco

  • medium: Risco médio

  • low: Baixo risco

  • none: Nenhum risco detectado

Frames

JSONArray

Informações sobre quadros de vídeo que acionaram uma correspondência de rótulo. Consulte Tabela 5 Frame para ver a estrutura.

Tabela 4: FrameSummary

Parâmetro

Tipo

Valor

Descrição

Label

String

violent_armedForces

Rótulo do quadro de vídeo.

Description

String

Suspeita de elementos relacionados a fogos de artifício

Descreve o campo Label.

Importante

Este campo fornece uma descrição do campo Label e está sujeito a alterações. Baseie sua lógica no campo Label, não neste.

LabelSum

Integer

8

Número de vezes que o rótulo aparece.

Tabela 5. frame

Parâmetro

Tipo

Exemplo

Descrição

TempUrl

String

http://www.aliyundoc.com/test.jpg

URL temporária para o quadro de vídeo. A URL é válida por 30 minutos.

Nota

Se o armazenamento de evidências de vídeo estiver ativado, este parâmetro retorna a URL do OSS do quadro de vídeo armazenado.

Offset

Float

50.5

Timestamp do quadro de vídeo em relação ao início do vídeo, em segundos.

RiskLevel

String

high

Nível de risco do quadro de vídeo, baseado nos limiares de pontuação de risco configurados. Valores válidos:

  • high: alto risco

  • medium: risco médio

  • low: baixo risco

  • none: nenhum risco detectado

Nota

Tome medidas imediatas para conteúdos de alto risco e revise manualmente conteúdos de risco médio. Trate conteúdos de baixo risco da mesma forma que conteúdos sem risco detectado, a menos que seja necessária alta taxa de recall. Configure as pontuações de risco para quadros de vídeo no console do Content Moderation.

Results

JSONArray

Array de objetos com os resultados da moderação do quadro de vídeo, como rótulos de risco e pontuações de confiança. Para mais informações, consulte Tabela 6. Results.

Tabela 6. Results

Parâmetro

Tipo

Valor

Descrição

Service

String

baselineCheck_global

Serviço de moderação de vídeo utilizado.

Result

Array

Array de objetos contendo os resultados da moderação quadro a quadro, como rótulos de risco e pontuações de confiança. Para mais informações, consulte Tabela 7 Result.

CustomImage

JSONArray

Informações de correspondência com biblioteca de imagens personalizadas. Retornado quando infoType é definido nos parâmetros da solicitação e há correspondência com uma biblioteca de imagens personalizadas. Para a estrutura, consulte Tabela 8 CustomImage.

TextInImage

JSONObject

Texto detectado no quadro capturado (resultado OCR). Retornado quando infoType é definido nos parâmetros da solicitação. Para a estrutura, consulte Tabela 9 TextInImage.

PublicFigure

JSONArray

Informações de correspondência com figuras públicas. Retornado quando infoType é definido nos parâmetros da solicitação e há correspondência com uma figura pública. Para a estrutura, consulte Tabela 10 PublicFigure.

LogoData

JSONArray

Informações de detecção de logotipos e marcas registradas. Retornado quando infoType é definido nos parâmetros da solicitação e há correspondência com um logotipo. Para a estrutura, consulte Tabela 11 LogoData.

VlContent

JSONObject

Resultados da análise de texto do large model. Retornado quando infoType é definido nos parâmetros da solicitação e um serviço de large model (como videoDetectionByVL) é utilizado. Para a estrutura, consulte Tabela 12 VlContent.

Tabela 7: Result

Parâmetro

Tipo

Valor de exemplo

Descrição

Label

String

violent_explosion

Rótulo do conteúdo detectado no quadro de vídeo. Um quadro pode ter múltiplos rótulos, cada um com sua pontuação de confiança correspondente. Os rótulos suportados incluem:

Confidence

Float

81.22

Pontuação de confiança de 0 a 100, arredondada para duas casas decimais.

Description

String

Suspeita de conteúdo relacionado a pirotecnia

Descrição do campo label.

Importante

Este campo descreve o campo label e está sujeito a alterações. Baseie a lógica da sua aplicação no campo label, não no campo Description.

Informações auxiliares na resposta (clique para expandir)

Tabela 8. CustomImage

Estrutura de dados com informações de correspondência da biblioteca de imagens personalizadas.

Parâmetro

Tipo

Valor de exemplo

Descrição

LibId

String

303074761XXXX

ID da biblioteca de imagens personalizadas correspondente.

ImageId

String

94XXXX

ID da imagem correspondente na biblioteca de imagens personalizadas.

Tabela 9. TextInImage

Informações de reconhecimento de texto detectadas no quadro capturado.

Parâmetro

Tipo

Valor de exemplo

Descrição

OcrDatas

JSONArray

["Great Wall ORA"]

Lista de strings de texto reconhecidas. Cada elemento representa um trecho de texto identificado.

Tabela 10. PublicFigure

Informações de correspondência de figuras públicas.

Parâmetro

Tipo

Valor de exemplo

Descrição

FigureId

String

3647ca8a

Identificador exclusivo da figura pública.

FigureName

String

XXX

Nome da figura pública identificada.

Location

JSONArray

[{"W":33,"H":42,"X":199,"Y":288}]

Coordenadas da figura pública no quadro capturado. W representa a largura, H a altura, e X e Y as coordenadas do canto superior esquerdo, todas em pixels.

Tabela 11. LogoData

Informações de detecção de logotipos e marcas registradas.

Parâmetro

Tipo

Valor de exemplo

Descrição

Location

JSONObject

{"W":175,"X":151,"H":174,"Y":192}

Localização do logotipo no quadro capturado. W indica a largura, H a altura, e X e Y as coordenadas do canto superior esquerdo, todas em pixels.

Tabela 12. VlContent

Resultados da análise de texto pelo modelo grande.

Parâmetro

Tipo

Valor de exemplo

Descrição

OutputText

String

Political, other. Military/police uniforms, minors, other flags, politically sensitive locations.

Resultado da análise de texto do modelo grande para o quadro capturado, incluindo categorias de risco detectadas e elementos de risco específicos.

Tabela 13: audioResult

Nota

Os campos de resposta para cada segmento de áudio na Tabela 15 SliceDetails variam conforme a versão do serviço de moderação de áudio selecionada na opção Audio Moderation Rules das configurações da sua regra de moderação de vídeo:

  • Versão do modelo grande: Os resultados de detecção de risco para cada segmento de áudio são retornados no campo result (consulte a Tabela 15 SliceDetails). Os campos Labels, RiskLevel, RiskWords e RiskTips podem não ser preenchidos.

  • Versão do modelo pequeno: Os resultados de detecção de risco aparecem nos campos Labels, RiskLevel, RiskWords e RiskTips.

Parâmetro

Tipo

Valor de exemplo

Descrição

AudioSummarys

JSONArray

Coleção de resumos de áudio. Consulte a Tabela 14 AudioSummarys para obter detalhes sobre a estrutura.

RiskLevel

String

high

Nível de risco calculado com base em todos os segmentos de áudio. Valores válidos:

  • high: Alto risco

  • medium: Risco médio

  • low: Baixo risco

  • none: Nenhum risco detectado

SliceDetails

JSONArray

Array de objetos que detalham cada segmento de áudio transcrito (geralmente uma única fala). Consulte a Tabela 15 SliceDetails para obter detalhes sobre a estrutura.

Tabela 14. Resumos de áudio

Parâmetro

Tipo

Valor

Descrição

Label

String

profanity

Rótulo de vídeo e áudio.

LabelSum

Integer

8

Contagem de rótulos.

Tabela 15: SliceDetails

Parâmetro

Tipo

Exemplo

Descrição

StartTime

Integer

0

Tempo inicial do segmento de áudio, em segundos.

EndTime

Integer

4065

Tempo final do segmento de áudio, em segundos.

StartTimestamp

Integer

1678854649720

Timestamp inicial do segmento, em milissegundos.

EndTimestamp

Integer

1678854649720

Timestamp final do segmento, em milissegundos.

Text

String

Disgusting

Texto transcrito do segmento de áudio.

Url

String

https://aliyundoc.com/test.wav

URL temporária para o arquivo do segmento de áudio, retornada para entradas de fluxo de áudio. Esta URL expira após 30 minutos. Salve o arquivo antes da expiração.

RiskLevel

String

high

Nível de risco do segmento de áudio. Os valores possíveis incluem:

  • high: Alto risco

  • medium: Risco médio

  • low: Baixo risco

  • none: Nenhum risco detectado

Labels

String

political_content,xxxx

Rótulos detectados, separados por vírgulas. Ao usar a versão do modelo pequeno do serviço de moderação de áudio, os resultados de risco são retornados nos campos Labels, RiskWords, RiskTips e Extend. Se a versão do modelo grande estiver selecionada, os resultados de risco aparecem no campo Result. Os valores possíveis incluem:

  • ad: Promoção relacionada a anúncios

  • violence: Conteúdo violento e terrorista

  • political_content: Conteúdo politicamente sensível

  • specified_speaking: Fala especificada

  • specified_lyrics: Letra de música especificada

  • sexual_content: Conteúdo pornográfico

  • sexual_sounds: Gemidos

  • contraband: Contrabando

  • profanity: Palavrões

  • religion: Conteúdo religioso

  • cyberbullying: Cyberbullying

  • negative_content: Conteúdo negativo

  • nontalk: Áudio silenciado

  • C_customized: Correspondência em biblioteca definida pelo usuário

RiskWords

String

AAA,BBB,CCC

Lista de palavras de risco correspondentes, separadas por vírgulas.

RiskTips

String

sexual_content_vulgar_words,sexual_content_description

Lista de rótulos detalhados, separados por vírgulas.

Extend

String

{"riskTips":"sexual_content_vulgar_words","riskWords":"sexual_services"}

Campo reservado.

Result

JSONArray

Resultados detalhados da detecção de risco para este segmento de áudio. Este campo é retornado apenas quando o serviço de moderação de áudio está configurado para usar a versão do modelo grande. Na versão do modelo pequeno, este campo não é retornado; os resultados de risco aparecem nos campos Labels, RiskWords, RiskTips, entre outros. A estrutura do campo é consistente com o campo Result da API do modelo grande de moderação de áudio. As descrições dos subcampos estão listadas abaixo.

Tabela 15-1. Result

Parâmetro

Tipo

Exemplo

Descrição

Label

String

political_entity

Rótulos retornados após a detecção de conteúdo de áudio. Vários rótulos e pontuações podem ser detectados. Inclui rótulos de política de texto e rótulos específicos de áudio:

  • Para rótulos de política de texto, consulte a seção Rótulos de risco

  • Os rótulos específicos de áudio incluem:

    • specified_nontalk: Áudio silencioso

    • specified_speaking: Voz especificada

    • sexual_sounds: Sons de gemidos

Nota

A detecção de voz especificada e sons de gemidos não está ativada por padrão. Entre em contato com seu gerente de conta para ativar essa detecção.

Description

String

Suspected pornographic content

Descrição do campo Label.

Importante

Este campo fornece uma explicação do campo Label e pode sofrer alterações. Ao processar os resultados, utilize o campo Label em vez deste campo.

Confidence

Float

81.22

Pontuação de confiança, variando de 0 a 100, arredondada para 2 casas decimais. Alguns rótulos podem não ter pontuação de confiança.

RiskLevel

String

high

Nível de risco do rótulo atual. Valores válidos:

  • high: Alto risco

  • medium: Risco médio

  • low: Baixo risco

  • none: Nenhum risco detectado

Riskwords

String

AA,BB,CC

Palavras sensíveis detectadas, separadas por vírgulas. Alguns rótulos podem não retornar palavras sensíveis.

CustomizedHit

JSONArray

[{"LibName":"...","Keywords":"..."}]

Quando há correspondência com uma biblioteca personalizada, o Label é definido como customized, e o nome da biblioteca personalizada e as palavras personalizadas são retornados. Para mais detalhes, consulte a Tabela 15-2 CustomizedHit.

RiskPositions

JSONArray

Informações de posição das palavras sensíveis detectadas. Para mais informações, consulte a Tabela 15-3 RiskPositions.

Tabela 15-2. CustomizedHit

Parâmetro

Tipo

Exemplo

Descrição

LibName

String

CustomLib1

Nome da biblioteca personalizada

Keywords

String

keyword1,keyword2

Palavras personalizadas, separadas por vírgulas.

Tabela 15-3. RiskPositions

Parâmetro

Tipo

Exemplo

Descrição

RiskWord

String

AA

Palavras sensíveis detectadas.

StartPos

Integer

10

Posição inicial da palavra sensível.

EndPos

Integer

12

Posição final da palavra sensível.

Instruções

  1. Leia o conteúdo em inglês para compreender O QUE precisa ser comunicado

  2. Escreva o português brasileiro DO ZERO — esqueça a estrutura das frases em inglês

  3. Preserve toda a formatação markdown, blocos de código, links e imagens exatamente como estão

  4. Tags xref (<a data-tag="xref" ...>texto</a>) — preserve a tag INTEIRA com todos os atributos na ordem e caixa originais, traduza APENAS o texto visível entre > e

  5. Aplique todas as regras específicas do idioma rigorosamente

  6. Aplique as regras de stopwords com tolerância zero

  7. Use o modo imperativo em passos numerados e listas de procedimentos

  8. Garanta consistência terminológica — mesmo termo = mesma tradução em todo o documento

  9. Varie os inícios de frase em listas/tabelas — nenhum início repetido mais de 3 vezes

  10. Retorne APENAS o documento markdown em português brasileiro, sem explicações

Exemplos

Exemplo de solicitação

{
    "Service": "videoDetection_global",
    "ServiceParameters": {
        "taskId": "abcd****"
    }
}

Resposta bem-sucedida

  • Detectar apenas quadros de vídeo

{
    "Code": 200,
    "RequestId": "25106421-XXXX-XXXX-XXXX-15DA5AAAC546",
    "Message": "Operation successful.",
    "Data": {
        "DataId": "ABCDEF-TESTDATAID",
        "TaskId": "AAAAA-BBBBB-2024-0307-0728",
        "FrameResult": {
            "FrameNum": 2,
            "FrameSummaries": [
                {
                    "Label": "violent_explosion",
                    "LabelSum": 8
                },
                {
                    "Label": "sexual_cleavage",
                    "LabelSum": 5
                }
            ],
            "Frames": [
                {
                    "Offset": 1,
                    "Results": [
                        {
                            "Result": [
                                {
                                    "Label": "nonLabel"
                                }
                            ],
                            "Service": "baselineCheck_global"
                        }
                    ],
                    "TempUrl": "http://abc.oss-ap-southeast-1.aliyuncs.com/test1.jpg"
                },
                {
                    "Offset": 2,
                    "Results": [
                        {
                            "Result": [
                                {
                                    "Confidence": 1,
                                    "Label": "sexual_cleavage"
                                },
                                {
                                    "Confidence": 74.1,
                                    "Label": "violent_explosion"
                                }
                            ],
                            "Service": "baselineCheck_global"
                        }
                    ],
                    "TempUrl": "http://abc.oss-ap-southeast-1.aliyuncs.com/test2.jpg"
                }
            ]
        }
    }
}
  • Analisar vídeo e áudio

{
    "Code": 200,
    "RequestId": "25106421-XXXX-XXXX-XXXX-15DA5AAAC546",
    "Message": "Success",
    "Data": {
        "DataId": "ABCDEF-TESTDATAID",
        "TaskId": "AAAAA-BBBBB-2024-0307-0728",
        "RiskLevel": "medium",
        "AudioResult": {
            "AudioSummarys": [
                {
                    "Label": "sexual_sounds",
                    "LabelSum": 3
                }
            ],
            "RiskLevel": "high",
            "SliceDetails": [
                {
                    "EndTime": 60,
                    "EndTimestamp": 1698912813192,
                    "Labels": "",
                    "RiskLevel": "none",
                    "StartTime": 30,
                    "StartTimestamp": 1698912783192,
                    "Text": "AI Guardrails",
                    "Url": "http://abc.oss-ap-southeast-1.aliyuncs.com/test.wav"
                },
                {
                    "EndTime": 30,
                    "EndTimestamp": 1698912813192,
                    "Extend": "{\"customizedWords\":\"service\",\"customizedLibs\":\"test\"}",
                    "Labels": "C_customized",
                    "RiskLevel": "high",
                    "StartTime": 0,
                    "StartTimestamp": 1698912783192,
                    "Text": "Welcome to Alibaba Cloud AI Guardrails service",
                    "Url": "http://abc.oss-ap-southeast-1.aliyuncs.com/test.wav"
                }
            ]
        },
        "FrameResult": {
            "FrameNum": 2,
            "FrameSummarys": [
                {
                    "Label": "violent_explosion",
                    "Description": "Suspected to contain content related to fireworks",
                    "LabelSum": 8
                },
                {
                    "Label": "sexual_cleavage",
                    "Description": "Suspected to contain body exposure or sexually suggestive content",
                    "LabelSum": 8
                }
            ],
            "RiskLevel": "medium",
            "Frames": [
                {
                    "Offset": 1,
                    "RiskLevel": "none",
                    "Results": [
                        {
                            "Result": [
                                {
                                    "Label": "nonLabel",
                                    "Description": "No risk detected"
                                }
                            ],
                            "Service": "baselineCheck_global"
                        }
                    ],
                    "TempUrl": "http://abc.oss-ap-southeast-1.aliyuncs.com/test1.jpg"
                },
                {
                    "Offset": 2,
                    "RiskLevel": "medium",
                    "Results": [
                        {
                            "Result": [
                                {
                                    "Confidence": 1,
                                    "Label": "sexual_cleavage",
                                    "Description": "Suspected to contain body exposure or sexually suggestive content"
                                },
                                {
                                    "Confidence": 74.1,
                                    "Label": "violent_explosion",
                                    "Description": "Suspected to contain content related to fireworks"
                                }
                            ],
                            "Service": "baselineCheck_global"
                        }
                    ],
                    "TempUrl": "http://abc.oss-ap-southeast-1.aliyuncs.com/test2.jpg"
                }
            ]
        }
    }
}
  • Quando informações auxiliares são retornadas

{
    "Code": 200,
    "RequestId": "ABCEDF-XXXX-XXXX-XXXX-202403070728520",
    "Message": "success finished",
    "Data": {
        "DataId": "ABCDEF-TESTDATAID",
        "TaskId": "AAAAA-BBBBB-2024-0307-0728",
        "RiskLevel": "medium",
        "FrameResult": {
            "FrameNum": 1,
            "FrameSummarys": [
                {
                    "Label": "logo_brand_lib",
                    "Description": "Trademark_custom library match",
                    "LabelSum": 1
                }
            ],
            "RiskLevel": "medium",
            "Frames": [
                {
                    "Offset": 1,
                    "RiskLevel": "medium",
                    "Results": [
                        {
                            "CustomImage": [
                                {
                                    "LibId": "303074761XXXX",
                                    "ImageId": "94XXXX"
                                }
                            ],
                            "Service": "postImageCheckByVL",
                            "Result": [
                                {
                                    "Description": "Trademark_custom library match",
                                    "Confidence": 84.97,
                                    "Label": "logo_brand_lib"
                                }
                            ],
                            "TextInImage": {
                                "OcrDatas": [
                                    "Great Wall ORA"
                                ]
                            },
                            "PublicFigure": [
                                {
                                    "FigureId": "3647ca8a",
                                    "FigureName": "XXX",
                                    "Location": [
                                        {
                                            "W": 33,
                                            "H": 42,
                                            "X": 199,
                                            "Y": 288
                                        }
                                    ]
                                }
                            ],
                            "LogoData": [
                                {
                                    "Logo": [
                                        {
                                            "confidence": 85.17,
                                            "name": "VOLVO",
                                            "label": "logo_brand"
                                        }
                                    ],
                                    "Location": {
                                        "W": 175,
                                        "X": 151,
                                        "H": 174,
                                        "Y": 192
                                    }
                                }
                            ],
                            "VlContent": {
                                "OutputText": "Political, other. Military/police uniforms, minors, other flags, politically sensitive locations."
                            }
                        }
                    ],
                    "TempUrl": "http://abc.oss-cn-shanghai.aliyuncs.com/test1.jpg"
                }
            ]
        }
    }
}

Código

Este tópico explica os valores de Code retornados pela API de auditoria de arquivos de vídeo 2.0. Apenas solicitações que retornam Code 200 ou 280 estão sujeitas a medição e faturamento; não há cobrança para quaisquer outras solicitações.

Code

Descrição

200

A solicitação foi bem-sucedida ou a detecção foi concluída.

280

A detecção está em andamento.

288

A tarefa está na fila em modo near-line.

400

Faltam um ou mais parâmetros obrigatórios na solicitação.

401

A solicitação contém um parâmetro inválido. Verifique o formato do parâmetro e tente novamente.

402

O comprimento de um parâmetro da solicitação excede o limite da API. Verifique o comprimento do parâmetro e tente novamente.

403

A taxa de solicitações excedeu o limite de QPS. Verifique e ajuste sua concorrência.

404

Falha ao baixar o vídeo. Verifique a URL do vídeo e tente novamente.

405

O download do vídeo expirou. O vídeo pode estar inacessível. Verifique a URL do vídeo e suas configurações de rede e tente novamente.

406

O tamanho do vídeo excede o limite permitido. Reduza o tamanho do vídeo e tente novamente.

407

O formato do vídeo não é suportado. Converta o vídeo para um formato compatível e tente novamente.

408

A conta não tem permissão para chamar esta API. Esse erro pode ocorrer se o serviço não estiver ativado, se houver pagamentos pendentes na conta ou se a conta não tiver autorização.

409

O TaskId especificado não existe, o que pode acontecer se o resultado tiver expirado. Os resultados têm um período de validade de 24 horas.

480

O número de fluxos de detecção simultâneos excedeu o limite. Verifique e ajuste suas configurações de concorrência.

500

Ocorreu um erro do sistema. Tente novamente mais tarde. Se o problema persistir, entre em contato com o suporte.

Instruções

  1. Leia o texto em inglês para entender O QUE precisa ser comunicado

  2. Escreva o português brasileiro DO ZERO — esqueça a estrutura das frases em inglês

  3. Preserve toda a formatação markdown, blocos de código, links e imagens exatamente como estão

  4. Tags xref (<a data-tag="xref" ...>texto</a>) — preserve a tag INTEIRA com todos os atributos na ordem e caixa originais, traduza APENAS o texto visível entre > e

  5. Aplique todas as regras específicas do idioma rigorosamente

  6. Aplique as regras de stopwords com tolerância zero

  7. Use o modo imperativo em etapas numeradas e listas de procedimentos

  8. Garanta a consistência terminológica — mesmo termo = mesma tradução em todo o documento

  9. Varie os inícios de frase em listas/tabelas — nenhum início repetido 3+ vezes

  10. Retorne APENAS o documento markdown em português brasileiro, sem explicações