Todos os produtos
Search
Central de documentação

AI Guardrails:Text moderation enhanced edition 2.0 multilingual plus

Última atualização: Jul 10, 2026

A Text Moderation Enhanced Edition V2.0 conta com um modelo multilíngue atualizado que detecta idiomas automaticamente e oferece suporte a mais tipos de linguagem. Desenvolvida para negócios internacionais, ela também disponibiliza políticas de moderação e um sistema de rótulos.

Enhanced Edition

Recursos

Em comparação ao service multilíngue da Text Moderation 1.0, a Text Moderation 2.0 utiliza uma política e um sistema de rotulagem separados para empresas globais. Além disso, oferece mais recursos para simplificar o uso e auxiliar na revisão manual.

Item

Text Moderation 2.0

Text Moderation 1.0

Suporte multilíngue

Oferece suporte a 38 idiomas.

Oferece suporte a 18 idiomas.

Capacidade de moderação

Utiliza vários modelos em paralelo. As políticas são mais precisas e adaptadas a idiomas e regiões específicos.

Utiliza um único modelo. As políticas equilibram precisão e recall com base nas características do idioma.

Sistema de rotulagem

Emprega um sistema de rotulagem internacionalizado que inclui rótulos para palavrões e conteúdo específico de cada região. Oferece suporte a múltiplos rótulos de risco e rótulos granulares.

Utiliza um sistema de rotulagem projetado para e oferece suporte apenas a um único rótulo de risco.

Escopo de detecção

É possível configurar todos os escopos de detecção no console, ativando-os ou desativando-os conforme necessário. Cada escopo tem correspondência direta com um resultado de detecção.

Oferece suporte a escopos de detecção gerais, que não possuem correspondência direta com os resultados de detecção.

Recursos da API

Fornece detecção automática sem exigir que você especifique o idioma de entrada. Após a moderação, a API retorna o tipo de idioma e uma versão traduzida do texto para inglês, facilitando a revisão manual.

Exige que você especifique o idioma de entrada e não retorna conteúdo traduzido.

Idiomas suportados

A moderação de texto V2.0 oferece suporte a 38 idiomas.

Idioma

Nome em inglês

Código do idioma

Inglês

English

en

Chinês simplificado

Simplified Chinese

zh

Chinês tradicional

Traditional Chinese

zh-tw

Indonésio

Indonesian

id

Malaio

Malay

ms

Tailandês

Thai

th

Vietnamita

Vietnamese

vi

Tagalo

Tagalog

tl

Híndi

Hindi

hi

Árabe

Arabic

ar

Turco

Turkish

tr

Francês

French

fr

Alemão

German

de

Russo

Russian

ru

Português

Portuguese

pt

Espanhol

Spanish

es

Italiano

Italian

it

Holandês

Dutch

nl

Polonês

Polish

pl

Japonês

Japanese

ja

Coreano

Korean

ko

Urdu

Urdu

ur

Uigur

Uighur

ug

Bengali

Bengali

bn

Persa

Persian

fa

Sueco

Swedish

sv

Dinamarquês

Danish

da

Norueguês

Norwegian

no

Islandês

Icelandic

is

Finlandês

Finnish

fi

Bielorrusso

Belarusian

be

Lituano

Lithuanian

lt

Tcheco

Czech

cs

Eslovaco

Slovak

sk

Húngaro

Hungarian

hu

Grego moderno

Modern Greek

el

Romeno

Romanian

ro

Irlandês

Irish

ga

Rótulos internacionalizados

O service Content Moderation 2.0 Multilingual PLUS utiliza um sistema de rótulos internacionalizado. Caso o conteúdo apresente múltiplos riscos, vários rótulos serão retornados. Os rótulos suportados são:

Rótulo

Pontuação de confiança

Descrição

pornographic_adult

0–100. Uma pontuação maior indica maior confiança.

Suspeita de conteúdo pornográfico

sexual_terms

0–100. Uma pontuação maior indica maior confiança.

Suspeita de conteúdo sobre saúde sexual

sexual_suggestive

0–100. Uma pontuação maior indica maior confiança.

Suspeita de conteúdo vulgar

sexual_orientation

0–100. Uma pontuação maior indica maior confiança.

Suspeita de conteúdo sobre orientação sexual

regional_cn

0–100. Uma pontuação maior indica maior confiança.

Suspeita de conteúdo político doméstico

regional_illegal

0–100. Uma pontuação maior indica maior confiança.

Suspeita de conteúdo político ilegal

regional_controversial

0–100. Uma pontuação maior indica maior confiança.

Suspeita de controvérsia política

regional_racism

0–100. Uma pontuação maior indica maior confiança.

Suspeita de racismo

violent_extremist

0–100. Uma pontuação maior indica maior confiança.

Suspeita de organizações extremistas

violent_incidents

0–100. Uma pontuação maior indica maior confiança.

Suspeita de conteúdo extremista

violent_weapons

0–100. Uma pontuação maior indica maior confiança.

Suspeita de armas e munições

violence_unscList

0–100. Uma pontuação maior indica maior confiança.

Lista Consolidada do Conselho de Segurança das Nações Unidas

contraband_drug

0–100. Uma pontuação maior indica maior confiança.

Suspeita de conteúdo relacionado a drogas

contraband_gambling

0–100. Uma pontuação maior indica maior confiança.

Suspeita de conteúdo relacionado a jogos de azar

inappropriate_ethics

0–100. Uma pontuação maior indica maior confiança.

Suspeita de conteúdo antiético

inappropriate_profanity

0–100. Uma pontuação maior indica maior confiança.

Suspeita de conteúdo abusivo ou ofensivo

inappropriate_oral

0–100. Uma pontuação maior indica maior confiança.

Suspeita de linguagem vulgar

inappropriate_religion

0–100. Uma pontuação maior indica maior confiança.

Suspeita de profanação religiosa

pt_to_contact

0–100. Uma pontuação maior indica maior confiança.

Suspeita de desvio de tráfego usando informações de contato

pt_to_sites

0–100. Uma pontuação maior indica maior confiança.

Suspeita de desvio de tráfego para sites externos

customized

0–100. Uma pontuação maior indica maior confiança.

Correspondência com palavra-chave em biblioteca personalizada

Faturamento

O service de moderação de texto 2.0 suporta pagamento conforme o uso .

Pagamento conforme o uso

Ao ativar o service de moderação de texto 2.0, o método de faturamento padrão é pagamento conforme o uso. A cobrança ocorre diariamente com base no uso real. Não há cobrança se você não utilizar o service.

Tipo de moderação

Service

Preço unitário

Moderação de texto padrão (text_standard)

Detecção multilíngue para negócios internacionais: text_multilingual_pro_global

USD 0,3 por 1.000 chamadas de API

Moderação de texto avançada (text_advanced)

Recurso de tradução de texto

USD 0,6 por 1.000 chamadas de API

Nota

Após ativar o recurso de tradução de texto, cada solicitação é cobrada uma vez a cada 500 caracteres.

Compensação por plano de recursos

Para demandas de moderação grandes ou consistentes, considere adquirir um plano de recursos. Planos maiores oferecem descontos maiores, e é possível acumular vários planos. Para mais informações, consulte Adquirir um plano de recursos para Content Moderation 2.0.

Este plano de recursos compensa o uso do Content Moderation 2.0 e não é compatível com planos de uso do Content Moderation 1.0. A tabela a seguir descreve os fatores de compensação.

Tipo de moderação

Service

Fator de compensação

Moderação de texto básica (text_standard)

Detecção multilíngue para negócios internacionais (pro): text_multilingual_pro_global

O fator de compensação é 1. Cada chamada de API bem-sucedida deduz 1 chamada de API da cota de uso do seu plano de recursos.

Nota

Por exemplo, se o seu plano de recursos tiver uma cota de uso de 10 chamadas de API, uma chamada bem-sucedida deduzirá 1 chamada do plano, restando um saldo de 9 chamadas.

Moderação de texto avançada (text_advanced)

Recurso de tradução de texto

O fator de compensação é 2. Cada chamada de API bem-sucedida deduz 2 chamadas de API da cota de uso do seu plano de recursos.

Nota

Por exemplo, se o seu plano de recursos tiver uma cota de uso de 10 chamadas de API, uma chamada bem-sucedida deduzirá 2 chamadas do plano, restando um saldo de 8 chamadas.

Integração

Etapa 1: Ativar o service

Para ativar o service Text Moderation 2.0 Edition, acesse Ativar Service.

Após ativar o service Text Moderation 2.0 Edition, o método de faturamento padrão é pagamento conforme o uso. A cobrança ocorre diariamente com base no uso real, e não há custo se você não chamar o service. Após a integração da API, o faturamento inicia automaticamente conforme o uso. Para mais informações, consulte Faturamento.

Etapa 2: Conceder permissões a um usuário RAM

Antes de integrar o SDK ou a API, conceda permissões a um usuário RAM. Crie uma AccessKey para sua conta Alibaba Cloud ou para um usuário RAM para autenticar as chamadas de API. Para detalhes, consulte Obter uma AccessKey.

Conceder permissões a um usuário RAM

  1. Faça login no console RAM usando sua conta Alibaba Cloud.

  2. Crie um usuário RAM. Para detalhes, consulte Criar um usuário RAM.

  3. Conceda a política de sistema AliyunYundunGreenWebFullAccess ao usuário RAM. Esta política concede acesso total ao Content Moderation. Para detalhes, consulte Gerenciar permissões de usuário RAM.

    O usuário RAM agora pode chamar a API do Content Moderation.

Etapa 3: Instalar e integrar o SDK

O service está disponível nas seguintes regiões. Para integrar o SDK da Text Moderation Enhanced Edition, consulte o Guia de Integração.

Região

Endpoint público

Endpoint interno

Singapore

green-cip.ap-southeast-1.aliyuncs.com

green-cip-vpc.ap-southeast-1.aliyuncs.com

UK (London)

green-cip.eu-west-1.aliyuncs.com

Não disponível

US (Virginia)

green-cip.us-east-1.aliyuncs.com

green-cip-vpc.us-east-1.aliyuncs.com

US (Silicon Valley)

green-cip.us-west-1.aliyuncs.com

Não disponível

Germany (Frankfurt)

green-cip.eu-central-1.aliyuncs.com

green-cip-vpc.eu-central-1.aliyuncs.com

Nota

Gerencie as configurações da região UK (London) no console da região Singapore e as da região US (Silicon Valley) no console da região US (Virginia).

API

Uso

  • Operação da API: TextModerationPlus

Use esta operação para criar uma tarefa de moderação de texto. Para construir uma solicitação HTTP, consulte Estrutura da solicitação. Também é possível usar uma solicitação HTTP pré-construída. Para mais informações, consulte Guia de integração.

  • Faturamento:

    Esta é uma operação paga. A cobrança ocorre apenas para solicitações bem-sucedidas que retornam código de status 200. Solicitações que retornam outros códigos de status não são cobradas. Para mais informações sobre faturamento, consulte Faturamento.

Limite de QPS

Esta operação tem limite de 100 solicitações por segundo por usuário. Chamadas que excedem esse limite sofrem limitação de taxa, o que pode afetar seus negócios. Planeje seu volume de chamadas adequadamente.

Parâmetros da solicitação

Parâmetro

Tipo

Obrigatório

Exemplo

Descrição

Service

String

Sim

text_multilingual_pro_global

O tipo de service de moderação. Defina o valor como text_multilingual_pro_global para moderação multilíngue em services internacionais.

ServiceParameters

JSONString

Sim

O conjunto de parâmetros para o service de moderação, fornecido como uma string JSON. Para detalhes sobre os parâmetros, consulte ServiceParameters.

Tabela 1. ServiceParameters

Parâmetro

Tipo

Obrigatório

Exemplo

Descrição

content

String

Sim

testing content

O conteúdo de texto a ser moderado. O conteúdo pode ter até 600 caracteres.

dataId

String

Não

text0424****

O ID de dados do objeto a ser moderado.

O ID pode conter letras maiúsculas e minúsculas, dígitos, sublinhados (_), hifens (-) e pontos (.). O ID pode ter até 64 caracteres e serve para identificar exclusivamente seus dados comerciais.

Parâmetros de resposta

Parâmetro

Tipo

Exemplo

Descrição

Code

Integer

200

O código de status. Para mais informações, consulte Detalhes do código.

Data

JSONObject

Os dados do resultado da moderação. Para mais informações, consulte Data.

Message

String

OK

A mensagem de resposta.

RequestId

String

AAAAAA-BBBB-CCCCC-DDDD-EEEEEEEE****

O ID da solicitação.

Tabela 2. Data

Parâmetro

Tipo

Exemplo

Descrição

Result

JSONArray

Os resultados da moderação, incluindo rótulos de risco, pontuações de confiança e outros detalhes. Para mais informações, consulte Result.

DataId

String

text0424****

O ID de dados do objeto moderado.

Nota

Este parâmetro é retornado apenas se dataId for especificado na solicitação.

RiskLevel

String

high

O nível de risco, determinado pelos limiares de pontuação de risco configurados. Valores válidos:

  • high: Alto risco. Se o conteúdo corresponder a uma palavra-chave em uma biblioteca personalizada, o nível de risco será definido como alto por padrão.

  • medium: Risco médio.

  • low: Baixo risco.

  • none: Nenhum risco detectado.

Nota

Recomendamos tratar conteúdos de alto risco diretamente e revisar manualmente os de risco médio. Processe conteúdos de baixo risco apenas se for necessária uma alta taxa de recall; caso contrário, podem ser considerados livres de risco. É possível configurar os limiares de pontuação de risco no console Content Moderation.

TranslatedContent

String

Texto traduzido

O conteúdo de texto traduzido. Retornado apenas após ativar o recurso de tradução de texto.

Nota

Atualmente, o recurso de tradução de texto é suportado apenas na região Singapore. Configure-o no gerenciamento de regras de detecção no console. Ativar este recurso gera taxas adicionais. Para detalhes de faturamento, consulte Faturamento.

DetectedLanguage

String

en

O idioma detectado.

Tabela 3. Result

Parâmetro

Tipo

Exemplo

Descrição

Label

String

political_xxx

O rótulo de moderação. Um único conteúdo pode receber múltiplos rótulos e pontuações de confiança. Para obter uma lista dos rótulos suportados, consulte Rótulos internacionalizados.

Confidence

Float

81,22

A pontuação de confiança, variando de 0 a 100. O valor tem precisão de duas casas decimais. Alguns rótulos não possuem pontuação de confiança.

Riskwords

String

AA,BB,CC

As palavras sensíveis detectadas. Múltiplas palavras sensíveis são separadas por vírgulas. Este parâmetro não é retornado para alguns rótulos.

CustomizedHit

JSONArray

[{"LibName":"...","Keywords":"..."}]

Retornado se o conteúdo corresponder a uma palavra-chave em uma biblioteca personalizada (quando Label é customized). Este parâmetro fornece o nome da biblioteca personalizada e as palavras-chave correspondentes. Para mais informações, consulte CustomizedHit.

Description

String

Suspeita de conteúdo pornográfico

Uma descrição do campo Label.

Importante

Este campo fornece uma explicação legível por humanos do Label e está sujeito a alterações. Para processamento automatizado, baseie sua lógica no campo Label, e não neste campo Description.

Tabela 4. CustomizedHit

Parâmetro

Tipo

Exemplo

Descrição

LibName

String

Biblioteca personalizada 1

O nome da biblioteca de palavras-chave personalizada.

Keywords

String

Palavra-chave personalizada 1,Palavra-chave personalizada 2

As palavras-chave personalizadas correspondentes. Múltiplas palavras-chave são separadas por vírgulas.

Exemplos

Exemplo de solicitação

{
    "Service": "text_multilingual_pro_global",
    "ServiceParameters": {
        "content": "testing content",
        "dataId": "text0424****"
    }
}

Exemplos de resposta

Correspondência com política do sistema:

{
    "Code": 200,
    "Data": {
        "Result": [
            {
                "Label": "political_entity",
                "Description": "Suspected political entity",
                "Confidence": 100.0,
                "RiskWords": "Word A,Word B,Word C"
            },
            {
                "Label": "political_figure",
                "Description": "Suspected political figure",
                "Confidence": 100.0,
                "RiskWords": "Word A,Word B,Word C"
            }
        ],
        "RiskLevel": "high",
        "DetectedLanguage": "en",
        "TranslatedContent": "Translated content",
        "DataId": "text0424****"
    },
    "Message": "OK",
    "RequestId": "AAAAAA-BBBB-CCCCC-DDDD-EEEEEEEE****"
}

Correspondência com biblioteca de palavras-chave personalizada:

{
    "Code": 200,
    "Data": {
        "Result": [
            {
                "Description": "Matched a custom keyword library",
                "CustomizedHit": [
                    {
                        "LibName": "Custom keyword library name 1",
                        "KeyWords": "Custom keyword"
                    }
                ],
                "Confidence": 100,
                "Label": "customized"
            }
        ],
        "RiskLevel": "high",
        "DataId": "text0424****"
    },
    "Message": "OK",
    "RequestId": "AAAAAA-BBBB-CCCCC-DDDD-EEEEEEEE****"
}

Código

Código

Código de status

Descrição

200

OK

A solicitação foi bem-sucedida.

400

BAD_REQUEST

Solicitação inválida. Verifique seus parâmetros de solicitação.

407

NOT_SUPPORT

O idioma não é reconhecido ou suportado.

408

PERMISSION_DENY

Permissão negada. Isso pode ocorrer se sua conta não estiver autorizada, tiver pagamentos pendentes, ou se o service estiver inativo ou bloqueado.

500

GENERAL_ERROR

Ocorreu um erro no servidor. Tente novamente a solicitação. Se o erro persistir, entre em contato conosco pelo suporte online.

581

TIMEOUT

A solicitação expirou. Tente novamente. Se o erro persistir, entre em contato conosco pelo suporte online.

588

EXCEED_QUOTA

A taxa de solicitações excede o limite de QPS.