O Text Moderation 2.02.0 aprimora as capacidades de modelos multilíngues com detecção automática de idioma e suporte expandido a idiomas. Ele oferece políticas de moderação e um sistema de rotulagem projetados para negócios internacionais. Este tópico descreve o serviço multilíngue do Text Moderation 2.02.0 e como utilizá-lo.
2.0
2.0
Recursos
Em comparação ao serviço de moderação multilíngue do Text Moderation 1.0, o Text Moderation 2.0 utiliza uma política e um sistema de rotulagem separados, desenvolvidos para negócios internacionais. Também fornece recursos adicionais para simplificar a integração e auxiliar na revisão manual.
Recurso | Text Moderation 2.0 | Text Moderation 1.0 |
Suporte a idiomas | Oferece suporte a 38 idiomas. | Oferece suporte a 18 idiomas. |
Capacidades de moderação | Executa vários modelos em paralelo, combinando características linguísticas e regionais para políticas mais precisas. | Utiliza um único modelo que incorpora características linguísticas. Sua política equilibra precisão e recall. |
Sistema de rotulagem | Emprega um sistema de rotulagem internacionalizada com rótulos adicionais para palavrões e conteúdo regional, além de suportar múltiplos rótulos de risco e subcategorias. | Utiliza o e suporta apenas um único rótulo de risco. |
Comportamento da API | Não exige que você especifique o idioma de entrada — ele detecta automaticamente o idioma. Após a moderação, o serviço retorna o tipo de idioma detectado e uma tradução do conteúdo para o inglês, auxiliando na revisão manual. | Exige que você especifique o idioma de entrada. Nenhuma tradução é retornada. |
Idiomas suportados
O Text Moderation 2.0 oferece suporte a 38 idiomas.
|
Idioma |
Nome |
Código do idioma |
|
Inglês |
English |
en |
|
Chinês simplificado |
Simplified Chinese |
zh |
|
Chinês tradicional |
Traditional Chinese |
zh-tw |
|
Indonésio |
Indonesian |
id |
|
Malaio |
Malay |
ms |
|
Tailandês |
Thai |
th |
|
Vietnamita |
Vietnamese |
vi |
|
Tagalo |
Tagalog |
tl |
|
Hindi |
Hindi |
hi |
|
Árabe |
Arabic |
ar |
|
Turco |
Turkish |
tr |
|
Francês |
French |
fr |
|
Alemão |
German |
de |
|
Russo |
Russian |
ru |
|
Português |
Portuguese |
pt |
|
Espanhol |
Spanish |
es |
|
Italiano |
Italian |
it |
|
Holandês |
Dutch |
nl |
|
Polonês |
Polish |
pl |
|
Japonês |
Japanese |
ja |
|
Coreano |
Korean |
ko |
|
Urdu |
Urdu |
ur |
|
Uigur |
Uyghur |
ug |
|
Bengali |
Bengali |
bn |
|
Persa |
Persian |
fa |
|
Sueco |
Swedish |
sv |
|
Dinamarquês |
Danish |
da |
|
Norueguês |
Norwegian |
no |
|
Islandês |
Icelandic |
is |
|
Finlandês |
Finnish |
fi |
|
Bielorrusso |
Belarusian |
be |
|
Lituano |
Lithuanian |
lt |
|
Tcheco |
Czech |
cs |
|
Eslovaco |
Slovak |
sk |
|
Húngaro |
Hungarian |
hu |
|
Grego |
Greek |
el |
|
Romeno |
Romanian |
ro |
|
Irlandês |
Irish |
ga |
Rótulos de internacionalização
O serviço multilíngue do Text Moderation 2.0 utiliza um sistema de rotulagem internacionalizado. Se o conteúdo contiver várias categorias de risco, o serviço retornará múltiplos rótulos simultaneamente. As categorias de rótulos incluem, mas não se limitam a:
Tipo | Categoria |
Rótulos de nível 1 (labels) |
|
Rótulos de subcategoria (riskTips) | Os rótulos de subcategoria são retornados no formato |
Métodos de faturamento
O Text Moderation 2.0 suporta faturamento por pagamento conforme o uso .
Pagamento conforme o uso
Ao ativar o serviço Text Moderation 2.0, o método de faturamento padrão é pagamento conforme o uso. A cobrança ocorre diariamente com base no uso real. Não há cobrança se você não chamar o serviço.
Tipo | Serviço | Preço unitário |
Moderação avançada de texto (text_standard) | Detecção multilíngue para negócios internacionais: comment_multilingual_global | USD 0,3 por 1.000 chamadas |
Moderação avançada de texto (text_advanced) | Recurso de tradução de texto | USD 0,6 por 1.000 chamadas Nota Após ativar o recurso de tradução de texto, cada solicitação é cobrada a cada 500 caracteres. |
Dedução de pacote de recursos
Se você tiver um alto volume de moderação ou necessidades relativamente consistentes, recomendamos a compra de um pacote de recursos. Pacotes maiores oferecem descontos maiores. É possível adquirir e acumular vários pacotes. Para mais informações, consulte Comprar um pacote de recursos para o Content Moderation 2.0.
Este pacote de recursos cobre o uso do Content Moderation 2.0 e não pode ser compartilhado com pacotes de tráfego do Content Security 1.0. Os fatores de dedução são os seguintes:
Tipo | Serviço | Fator de dedução |
Moderação avançada de texto (text_standard) | Detecção multilíngue para negócios internacionais: comment_multilingual_global | O fator de dedução é 1, ou seja, cada chamada de API bem-sucedida deduz 1 unidade da capacidade do pacote de recursos. Nota Por exemplo, se seu pacote de recursos tiver capacidade para 10 chamadas, uma chamada de API bem-sucedida deduzirá 1 chamada, restando um saldo de 9 chamadas. |
Moderação avançada de texto (text_advanced) | Recurso de tradução de texto | O fator de dedução é 2, ou seja, cada chamada de API bem-sucedida deduz 2 unidades da capacidade do pacote de recursos. Nota Por exemplo, se seu pacote de recursos tiver capacidade para 10 chamadas, uma chamada de API bem-sucedida deduzirá 2 chamadas, restando um saldo de 8 chamadas. |
Integração
Etapa 1: Ativar o serviço
Acesse a página de ativação do serviço para ativar o serviço Text Moderation 2.0.
Após ativar o serviço Text Moderation 2.0, o método de faturamento padrão é pagamento conforme o uso. A cobrança ocorre diariamente com base no uso real. Não há cobrança se você não chamar o serviço. Após a integração com a API, o sistema gera automaticamente as faturas com base no seu uso. Para mais informações, consulte Faturamento.
Etapa 2: Conceder permissões a um usuário RAM
Antes de integrar o SDK ou chamar a API, conceda as permissões necessárias a um usuário RAM. Crie um par de AccessKey para sua conta Alibaba Cloud ou para um usuário RAM. Todas as chamadas de API exigem um AccessKey para autenticação. Para obter instruções, consulte Obter um AccessKey.
Conceder permissões a um usuário RAM
Faça login no RAM console usando sua conta Alibaba Cloud.
Crie um usuário RAM. Para detalhes, consulte Criar um usuário RAM.
-
Conceda a política de sistema
AliyunYundunGreenWebFullAccessao usuário RAM. Essa política concede acesso total ao Content Moderation. Para detalhes, consulte Gerenciar permissões de usuário RAM.O usuário RAM agora pode chamar a API do Content Moderation.
Etapa 3: Integrar o SDK
A tabela a seguir lista as regiões suportadas. Para o SDK do Text Moderation Enhanced Edition, consulte o Guia de integração.
|
Região |
Endpoint público |
Endpoint VPC |
|
Singapura |
green-cip.ap-southeast-1.aliyuncs.com |
green-cip-vpc.ap-southeast-1.aliyuncs.com |
|
EUA (Virgínia) |
green-cip.us-east-1.aliyuncs.com |
green-cip-vpc.us-east-1.aliyuncs.com |
|
EUA (Vale do Silício) |
green-cip.us-west-1.aliyuncs.com |
N/A |
|
Reino Unido (Londres) |
green-cip.eu-west-1.aliyuncs.com |
N/A |
Se precisar de código de exemplo do SDK em outras linguagens de programação, utilize o OpenAPI Explorer para depurar operações de API online. A ferramenta gera automaticamente códigos de exemplo do SDK para a API correspondente.
API
Uso
Endpoint: https://green-cip.{region}.aliyuncs.com.
Chame esta operação para criar uma tarefa de moderação de conteúdo de texto. Para saber como construir uma solicitação HTTP, consulte Estrutura da solicitação. Você também pode usar uma solicitação HTTP pré-construída. Para mais informações, consulte o Guia de acesso.
-
Faturamento:
Esta é uma operação paga. Apenas solicitações que retornam um código de status HTTP 200 são medidas e faturadas. Solicitações que retornam outros códigos de erro não são cobradas. Para mais informações sobre faturamento, consulte Métodos de faturamento.
Limite de QPS
O limite de QPS por usuário para esta operação é de 100 chamadas por segundo. Exceder esse limite aciona o throttling, o que pode afetar seus negócios. Planeje suas chamadas de API adequadamente.
Parâmetros da solicitação
Parâmetro | Tipo | Obrigatório | Exemplo | Descrição |
Service | String | Sim | comment_multilingual_global | O tipo de serviço de moderação. Defina o valor como comment_multilingual_global para detecção multilíngue em negócios internacionais. |
ServiceParameters | JSONString | Sim | O conjunto de parâmetros exigido pelo serviço de moderação, no formato de string JSON. Para descrições de cada campo, consulte ServiceParameters. |
Tabela 1. ServiceParameters
|
Parâmetro |
Tipo |
Obrigatório |
Exemplo |
Descrição |
|
content |
String |
Sim |
testing content |
O conteúdo de texto a ser moderado. Comprimento máximo: 600 caracteres. |
|
dataID |
String |
Não |
text0424**** |
O ID de dados correspondente ao objeto a ser moderado. Contém letras maiúsculas e minúsculas, dígitos, sublinhados (_), hifens (-) e pontos (.). Comprimento máximo: 64 caracteres. Use este campo para identificar exclusivamente seus dados comerciais. |
|
accountID |
String |
Não |
10123**** |
O ID da conta que identifica exclusivamente uma conta. |
|
deviceID |
String |
Não |
20240307**** |
O ID do dispositivo que identifica exclusivamente um dispositivo. |
|
deviceToken |
String |
Não |
MzQvo1d7scyZ3tl_RcJ |
O token do dispositivo obtido por meio do SDK de controle de riscos. |
Parâmetros de resposta
|
Parâmetro |
Tipo |
Exemplo |
Descrição |
|
Code |
Integer |
200 |
O código de status. Para mais informações, consulte Códigos de erro. |
|
Data |
JSONObject |
Os dados do resultado da moderação. Para mais informações, consulte Data. |
|
|
Message |
String |
OK |
A mensagem de resposta da solicitação. |
|
RequestID |
String |
AAAAAA-BBBB-CCCCC-DDDD-EEEEEEEE**** |
O ID da solicitação. |
Tabela 2. Data
Parâmetro | Tipo | Exemplo | Descrição |
Labels | String | sexual_content | Os rótulos de risco. Vários rótulos são separados por vírgulas (,). Valores válidos:
|
Reason | String | {"customizedWords": "HXXXXX","detectedLanguage": "en","riskTips": "sexuality_Suggestive","riskWords": "pxxxxy","translatedContent": "pxxxxy sxxxx, HXXXXX","customizedLibs": "ZXXXXX"} | Uma string JSON para localizar o motivo, que inclui os seguintes campos:
|
AccountID | String | 10123**** | O ID da conta. Nota Este campo é retornado apenas se você passar |
DeviceID | String | 20240307**** | O ID do dispositivo. Nota Este campo é retornado apenas se você passar |
Exemplos
Exemplo de solicitação
{
"Service": "comment_multilingual_global",
"ServiceParameters": {
"content": "testing content",
"accountId": "10123****",
"dataId": "text0424****"
}
}
Exemplos de resposta:
Se forem detectadas tanto palavras-chave personalizadas quanto conteúdo de risco:
{
"Code": 200,
"Data": {
"DataId": "text0424****",
"Labels": "C_customized,profanity",
"Reason": "{\"riskLevel\":\"high\",\"customizedWords\":\"HXXXXX\",\"detectedLanguage\":\"en\",\"riskTips\":\"sexuality_Suggestive\",\"riskWords\":\"pxxxxy\",\"translatedContent\":\"pxxxxy sxxxx, HXXXXX\",\"customizedLibs\":\"ZXXXXX\"}"
},
"Message": "OK",
"RequestId": "AAAAAA-BBBB-CCCCC-DDDD-EEEEEEEE****"
}
Se apenas palavras-chave personalizadas forem detectadas:
{
"Code": 200,
"Data": {
"DataId": "text0424****",
"Labels": "C_customized",
"Reason": "{\"riskLevel\":\"high\",\"customizedWords\":\"HXXXXX\",\"detectedLanguage\":\"en\",\"translatedContent\":\"HXXXXX\",\"customizedLibs\":\"ZXXXXX\"}"
},
"Message": "OK",
"RequestId": "AAAAAA-BBBB-CCCCC-DDDD-EEEEEEEE****"
}
Se apenas conteúdo de risco for detectado:
{
"Code": 200,
"Data": {
"DataId": "text0424****",
"Labels": "sexuality",
"Reason": "{\"riskLevel\":\"high\",\"detectedLanguage\":\"ar\",\"riskTips\":\"sexuality_Suggestive\",\"riskWords\":\"pxxxxy\",\"translatedContent\":\"pxxxxy sxxxx\"}"
},
"Message": "OK",
"RequestId": "AAAAAA-BBBB-CCCCC-DDDD-EEEEEEEE****"
}
Se nem palavras-chave personalizadas nem conteúdo de risco forem detectados:
{
"Code": 200,
"Data": {
"DataId": "text0424****",
"Labels": "",
"Reason": "{\"detectedLanguage\":\"en\",\"translatedContent\":\"AXXXXXX\"}"
},
"Message": "OK",
"RequestId": "AAAAAA-BBBB-CCCCC-DDDD-EEEEEEEE****"
}
Códigos de erro
Código | Mensagem de status | Descrição |
200 | OK | A solicitação foi bem-sucedida. |
400 | BAD_REQUEST | Solicitação inválida. Verifique seus parâmetros de solicitação. |
407 | NOT_SUPPORT | O idioma especificado não é reconhecido ou não é suportado. |
408 | PERMISSION_DENY | Possíveis causas: a conta não está autorizada, possui pagamentos atrasados, o serviço não está ativado ou a conta está desabilitada. |
500 | GENERAL_ERROR | Ocorreu um erro interno do servidor. Tente novamente a solicitação. Se o erro persistir, entre em contato com Support and Services. |
581 | TIMEOUT | A solicitação atingiu o tempo limite. Tente novamente. Se o erro persistir, entre em contato com Support and Services. |
588 | EXCEED_QUOTA | A frequência da solicitação excede o limite de QPS. |