Todos os produtos
Search
Central de documentação

Realtime Compute for Apache Flink:Flink AI service (built-in models)

Última atualização: Sep 19, 2026

Este tópico descreve os recursos, o uso e os limites do Flink AI service (built-in models) no Realtime Compute for Apache Flink.

Visão geral

O Flink AI service (built-in models) é uma capacidade gerenciada de invocação de modelos de IA do Realtime Compute for Apache Flink. Invoque modelos integrados pela rede privada em jobs do Flink sem precisar configurar uma API-Key ou PrivateLink, habilitando inferência de IA em streaming, embedding, síntese de voz, reconhecimento de voz, geração de imagens, geração de vídeos e ranking.

Principais vantagens

Recurso

Descrição

Pronto para uso

Não é necessário configurar API-Key, endpoint ou PrivateLink.

Faturamento por uso

Diversos métodos de faturamento são suportados, como por token, por duração e por número de imagens, com custos claros e controláveis.

Suporte a múltiplos modelos

Vários grandes modelos mainstream estão integrados, cobrindo cenários como geração de texto, compreensão multimodal, síntese de voz, reconhecimento de voz, geração de imagens, geração de vídeos, embedding e ranking.

Cobertura global de regiões

Disponível em múltiplas regiões dentro e fora do território continental da China, com acesso cross-region automático.

Como funciona

image

Ativar e desativar o service

Ativar o service

Acesse o console de gerenciamento do Realtime Compute for Apache Flink. Na página Flink AI Service, clique em Activate.

  • O service deve ser ativado por uma conta principal ou por um usuário RAM com as permissões AliyunBSSOrderAccess e AliyunStreamFullAccess.

  • Após a ativação em uma região, todos os workspaces dessa região poderão utilizá-lo.

  • Este recurso opera no modelo pagamento conforme o uso. A cobrança ocorre apenas pelas invocações de modelos, não pela ativação do recurso. Para mais detalhes, consulte AI service billing (pay-as-you-go).

Desativar o service

Na página Flink AI Service, clique em Disable Service e confirme as seguintes condições:

  • Após desativar o recurso, todos os jobs da região deixarão de ter acesso ao service de modelos integrados.

  • Antes de desativar, certifique-se de que nenhum job depende dos modelos integrados.

Proteção do service

Para evitar interrupções inesperadas causadas pela desativação acidental do service, ative a proteção do service no console.

Com a proteção ativada, o sistema rejeita todas as solicitações de liberação manual iniciadas pelo console, API ou CLI. Esse recurso é suportado apenas no modo de pagamento conforme o uso do Flink AI service e se aplica exclusivamente a operações de liberação manual. Ele não entra em vigor nos seguintes cenários em que o sistema libera o service automaticamente:

  • O service é desativado por inadimplência na conta.

  • O service é liberado de forma forçada por violação das regras de segurança da plataforma cloud.

Regiões suportadas

International site

Flink AI service region

Region ID

Endpoint region

Inference execution region

China (Beijing)

cn-beijing

China (Beijing)

Chinese mainland (dynamic scheduling)

China (Zhangjiakou)

cn-zhangjiakou

China (Shanghai)

cn-shanghai

China (Hangzhou)

cn-hangzhou

China (Shenzhen)

cn-shenzhen

China (Chengdu)

cn-chengdu

Singapore

ap-southeast-1

Singapore

Regions outside the Chinese mainland (dynamic scheduling)

China (Hong Kong)

cn-hongkong

Malaysia (Kuala Lumpur)

ap-southeast-3

Indonesia (Jakarta)

ap-southeast-5

Japan (Tokyo)

ap-northeast-1

Korea (Seoul)

ap-northeast-2

Thailand (Bangkok)

ap-southeast-7

UAE (Dubai)

me-east-1

Mexico

na-south-1

US (Virginia)

us-east-1

US (Silicon Valley)

us-west-1

Importante

A região determina a localização física do acesso aos dados e da execução de inferência. Selecione uma região com base nos seus requisitos de conformidade de dados.

  • Endpoint region: Define o ponto de acesso e o local de armazenamento dos dados.

  • Inference execution region: Local onde a inferência é executada. O agendamento ocorre dinamicamente dentro de um escopo definido.

Ao selecionar uma região fora do território continental da China, os dados do seu negócio serão transferidos internacionalmente para a região Singapore e, conforme necessário, agendados dinamicamente para nós do service de inferência fora do território continental da China para processamento. Você deve garantir que essas transferências internacionais de dados estejam em conformidade com todas as leis, regulamentos e requisitos regulatórios aplicáveis, incluindo, entre outros: os dados transferidos não podem conter nenhum conteúdo que as leis aplicáveis restrinjam ou proíbam de ser transferido internacionalmente; todos os procedimentos de aprovação ou registro necessários devem ter sido concluídos; e todas as obrigações de notificação exigidas devem ter sido cumpridas e os consentimentos necessários devem ter sido obtidos.

Modelos integrados

Família de modelos

Modelo

Capacidades

Regiões suportadas

Qwen

qwen3.8-max

Geração de texto, raciocínio, compreensão visual

Todas

qwen3.7-max

Geração de texto, raciocínio

Todas

qwen3.7-plus

Geração de texto, raciocínio, compreensão visual

Todas

qwen3.6-plus

Geração de texto, raciocínio, compreensão visual

Todas

qwen3.5-plus

Geração de texto, raciocínio, compreensão visual

Todas

qwen3.7-flash

Geração de texto, raciocínio, compreensão visual

Todas

qwen3.6-flash

Geração de texto, raciocínio, compreensão visual

Todas

qwen3.5-flash

Geração de texto, raciocínio, compreensão visual

Todas

qwen3.5-omni-plus

Geração de texto, raciocínio, compreensão multimodal

Todas

qwen3.5-omni-flash

Geração de texto, raciocínio, compreensão multimodal

Todas

qwen3.5-ocr

OCR

Território continental da China

qwen-vl-ocr

OCR

Todas

qwen-mt-plus

Tradução

Todas

qwen-mt-flash

Tradução

Todas

DeepSeek

deepseek-v4-flash-0731

Geração de texto, raciocínio

Todas

deepseek-v4-pro

Geração de texto, raciocínio

Todas

GLM

glm-5.2

Geração de texto, raciocínio

Todas

Embedding

qwen3.7-text-embedding

Embedding de texto

Território continental da China

text-embedding-v4

Embedding de texto

Todas

qwen3-vl-embedding

Embedding multimodal

Território continental da China

Rerank

qwen3-rerank

Ranking de texto

Todas

qwen3-vl-rerank

Ranking multimodal

Território continental da China

Qwen-Audio-TTS

qwen-audio-3.0-tts-plus

Síntese de voz (texto para fala)

Todas

qwen-audio-3.0-tts-flash

Síntese de voz (texto para fala)

Todas

CosyVoice

cosyvoice-v3.5-plus

Síntese de voz (texto para fala)

Território continental da China

cosyvoice-v3.5-flash

Síntese de voz (texto para fala)

Território continental da China

Qwen-Audio-ASR

qwen-audio-3.0-asr-flash-filetrans

Reconhecimento de voz (fala para texto), tradução de voz (fala para texto em um idioma especificado)

Todas

qwen-audio-3.0-asr-flash

Reconhecimento de voz (fala para texto), tradução de voz (fala para texto em um idioma especificado)

Todas

Fun-ASR

fun-asr

Reconhecimento de voz (fala para texto), tradução de voz (fala para texto em um idioma especificado)

Todas

Qwen-Image

qwen-image-3.0

Geração e edição de imagens

Todas

qwen-image-3.0-pro

Geração e edição de imagens

Todas

HappyHorse

happyhorse-1.1-t2v

Geração de vídeo (texto para vídeo)

Todas

happyhorse-1.1-i2v

Geração de vídeo (imagem para vídeo)

Todas

Uso

SQL

Especifique os parâmetros task e model na instrução CREATE MODEL. Não é necessário especificar endpoint nem api-key.

CREATE MODEL model_name
INPUT (column_name STRING)
OUTPUT (column_name {STRING | ARRAY<FLOAT>})
WITH (
  'provider' = 'openai-compat | dashscope',
  'task' = 'chat/completions | embeddings | multimodal-embedding',
  'model' = '<model-name>'
);

Para mais detalhes, consulte Model configuration.

Pyflink Dataframe

Especifique <!--@code {"id":"z7c2pako06nq0"}