Este tópico descreve os recursos, o uso e os limites do Flink AI service (built-in models) no Realtime Compute for Apache Flink.
Visão geral
O Flink AI service (built-in models) é uma capacidade gerenciada de invocação de modelos de IA do Realtime Compute for Apache Flink. Invoque modelos integrados pela rede privada em jobs do Flink sem precisar configurar uma API-Key ou PrivateLink, habilitando inferência de IA em streaming, embedding, síntese de voz, reconhecimento de voz, geração de imagens, geração de vídeos e ranking.
Principais vantagens
|
Recurso |
Descrição |
|
Pronto para uso |
Não é necessário configurar API-Key, endpoint ou PrivateLink. |
|
Faturamento por uso |
Diversos métodos de faturamento são suportados, como por token, por duração e por número de imagens, com custos claros e controláveis. |
|
Suporte a múltiplos modelos |
Vários grandes modelos mainstream estão integrados, cobrindo cenários como geração de texto, compreensão multimodal, síntese de voz, reconhecimento de voz, geração de imagens, geração de vídeos, embedding e ranking. |
|
Cobertura global de regiões |
Disponível em múltiplas regiões dentro e fora do território continental da China, com acesso cross-region automático. |
Como funciona
Ativar e desativar o service
Ativar o service
Acesse o console de gerenciamento do Realtime Compute for Apache Flink. Na página Flink AI Service, clique em Activate.
O service deve ser ativado por uma conta principal ou por um usuário RAM com as permissões AliyunBSSOrderAccess e AliyunStreamFullAccess.
Após a ativação em uma região, todos os workspaces dessa região poderão utilizá-lo.
Este recurso opera no modelo pagamento conforme o uso. A cobrança ocorre apenas pelas invocações de modelos, não pela ativação do recurso. Para mais detalhes, consulte AI service billing (pay-as-you-go).
Desativar o service
Na página Flink AI Service, clique em Disable Service e confirme as seguintes condições:
Após desativar o recurso, todos os jobs da região deixarão de ter acesso ao service de modelos integrados.
Antes de desativar, certifique-se de que nenhum job depende dos modelos integrados.
Proteção do service
Para evitar interrupções inesperadas causadas pela desativação acidental do service, ative a proteção do service no console.
Com a proteção ativada, o sistema rejeita todas as solicitações de liberação manual iniciadas pelo console, API ou CLI. Esse recurso é suportado apenas no modo de pagamento conforme o uso do Flink AI service e se aplica exclusivamente a operações de liberação manual. Ele não entra em vigor nos seguintes cenários em que o sistema libera o service automaticamente:
O service é desativado por inadimplência na conta.
O service é liberado de forma forçada por violação das regras de segurança da plataforma cloud.
Regiões suportadas
International site
|
Flink AI service region |
Region ID |
Endpoint region |
Inference execution region |
|
China (Beijing) |
cn-beijing |
China (Beijing) |
Chinese mainland (dynamic scheduling) |
|
China (Zhangjiakou) |
cn-zhangjiakou |
||
|
China (Shanghai) |
cn-shanghai |
||
|
China (Hangzhou) |
cn-hangzhou |
||
|
China (Shenzhen) |
cn-shenzhen |
||
|
China (Chengdu) |
cn-chengdu |
||
|
Singapore |
ap-southeast-1 |
Singapore |
Regions outside the Chinese mainland (dynamic scheduling) |
|
China (Hong Kong) |
cn-hongkong |
||
|
Malaysia (Kuala Lumpur) |
ap-southeast-3 |
||
|
Indonesia (Jakarta) |
ap-southeast-5 |
||
|
Japan (Tokyo) |
ap-northeast-1 |
||
|
Korea (Seoul) |
ap-northeast-2 |
||
|
Thailand (Bangkok) |
ap-southeast-7 |
||
|
UAE (Dubai) |
me-east-1 |
||
|
Mexico |
na-south-1 |
||
|
US (Virginia) |
us-east-1 |
||
|
US (Silicon Valley) |
us-west-1 |
A região determina a localização física do acesso aos dados e da execução de inferência. Selecione uma região com base nos seus requisitos de conformidade de dados.
Endpoint region: Define o ponto de acesso e o local de armazenamento dos dados.
Inference execution region: Local onde a inferência é executada. O agendamento ocorre dinamicamente dentro de um escopo definido.
Ao selecionar uma região fora do território continental da China, os dados do seu negócio serão transferidos internacionalmente para a região Singapore e, conforme necessário, agendados dinamicamente para nós do service de inferência fora do território continental da China para processamento. Você deve garantir que essas transferências internacionais de dados estejam em conformidade com todas as leis, regulamentos e requisitos regulatórios aplicáveis, incluindo, entre outros: os dados transferidos não podem conter nenhum conteúdo que as leis aplicáveis restrinjam ou proíbam de ser transferido internacionalmente; todos os procedimentos de aprovação ou registro necessários devem ter sido concluídos; e todas as obrigações de notificação exigidas devem ter sido cumpridas e os consentimentos necessários devem ter sido obtidos.
Modelos integrados
|
Família de modelos |
Modelo |
Capacidades |
Regiões suportadas |
|
Qwen |
qwen3.8-max |
Geração de texto, raciocínio, compreensão visual |
Todas |
|
qwen3.7-max |
Geração de texto, raciocínio |
Todas |
|
|
qwen3.7-plus |
Geração de texto, raciocínio, compreensão visual |
Todas |
|
|
qwen3.6-plus |
Geração de texto, raciocínio, compreensão visual |
Todas |
|
|
qwen3.5-plus |
Geração de texto, raciocínio, compreensão visual |
Todas |
|
|
qwen3.7-flash |
Geração de texto, raciocínio, compreensão visual |
Todas |
|
|
qwen3.6-flash |
Geração de texto, raciocínio, compreensão visual |
Todas |
|
|
qwen3.5-flash |
Geração de texto, raciocínio, compreensão visual |
Todas |
|
|
qwen3.5-omni-plus |
Geração de texto, raciocínio, compreensão multimodal |
Todas |
|
|
qwen3.5-omni-flash |
Geração de texto, raciocínio, compreensão multimodal |
Todas |
|
|
qwen3.5-ocr |
OCR |
Território continental da China |
|
|
qwen-vl-ocr |
OCR |
Todas |
|
|
qwen-mt-plus |
Tradução |
Todas |
|
|
qwen-mt-flash |
Tradução |
Todas |
|
|
DeepSeek |
deepseek-v4-flash-0731 |
Geração de texto, raciocínio |
Todas |
|
deepseek-v4-pro |
Geração de texto, raciocínio |
Todas |
|
|
GLM |
glm-5.2 |
Geração de texto, raciocínio |
Todas |
|
Embedding |
qwen3.7-text-embedding |
Embedding de texto |
Território continental da China |
|
text-embedding-v4 |
Embedding de texto |
Todas |
|
|
qwen3-vl-embedding |
Embedding multimodal |
Território continental da China |
|
|
Rerank |
qwen3-rerank |
Ranking de texto |
Todas |
|
qwen3-vl-rerank |
Ranking multimodal |
Território continental da China |
|
|
Qwen-Audio-TTS |
qwen-audio-3.0-tts-plus |
Síntese de voz (texto para fala) |
Todas |
|
qwen-audio-3.0-tts-flash |
Síntese de voz (texto para fala) |
Todas |
|
|
CosyVoice |
cosyvoice-v3.5-plus |
Síntese de voz (texto para fala) |
Território continental da China |
|
cosyvoice-v3.5-flash |
Síntese de voz (texto para fala) |
Território continental da China |
|
|
Qwen-Audio-ASR |
qwen-audio-3.0-asr-flash-filetrans |
Reconhecimento de voz (fala para texto), tradução de voz (fala para texto em um idioma especificado) |
Todas |
|
qwen-audio-3.0-asr-flash |
Reconhecimento de voz (fala para texto), tradução de voz (fala para texto em um idioma especificado) |
Todas |
|
|
Fun-ASR |
fun-asr |
Reconhecimento de voz (fala para texto), tradução de voz (fala para texto em um idioma especificado) |
Todas |
|
Qwen-Image |
qwen-image-3.0 |
Geração e edição de imagens |
Todas |
|
qwen-image-3.0-pro |
Geração e edição de imagens |
Todas |
|
|
HappyHorse |
happyhorse-1.1-t2v |
Geração de vídeo (texto para vídeo) |
Todas |
|
happyhorse-1.1-i2v |
Geração de vídeo (imagem para vídeo) |
Todas |
Uso
SQL
Especifique os parâmetros task e model na instrução CREATE MODEL. Não é necessário especificar endpoint nem api-key.
CREATE MODEL model_name
INPUT (column_name STRING)
OUTPUT (column_name {STRING | ARRAY<FLOAT>})
WITH (
'provider' = 'openai-compat | dashscope',
'task' = 'chat/completions | embeddings | multimodal-embedding',
'model' = '<model-name>'
);
Para mais detalhes, consulte Model configuration.
Pyflink Dataframe
Especifique <!--@code {"id":"z7c2pako06nq0"}