Todos os produtos
Search
Central de documentação

DataWorks:Gerencie serviços de modelos grandes

Última atualização: Jun 27, 2026

Os serviços de modelos grandes do DataWorks permitem implantar modelos em grupos de recursos serverless e chamá-los diretamente nas tarefas de desenvolvimento de dados. Todo o tráfego permanece na rede privada via PrivateLink, o que garante a segurança dos dados.

Modelos compatíveis

Categoria

Modelo

Descrição

Modelo de linguagem grande

Qwen3-32B

O Qwen3 é a geração mais recente de modelos de linguagem grande da série Qwen. Ele oferece um conjunto completo de modelos densos e Mixture-of-Experts (MoE) com capacidades avançadas de raciocínio, seguimento de instruções, funções de agente e suporte multilíngue. Qwen3.

Importante
  • A implantação dos modelos 0,6B, 1,7B, 4B e 8B exige no mínimo 24 GB de memória GPU.

  • Para implantar o modelo 14B, são necessários pelo menos 48 GB de memória GPU.

  • O modelo 32B requer um mínimo de 96 GB de memória GPU para ser implantado.

Qwen3-14B

Qwen3-8B

Qwen3-4B

Qwen3-1,7B

Qwen3-0,6B

Qwen3-Embedding-8B

Qwen3-Embedding-4B

Qwen3-Embedding-0,6B

DeepSeek-R1-0528-Qwen3-8B

O DeepSeek utiliza extensivamente aprendizado por reforço, melhorando significativamente as capacidades de inferência com dados anotados mínimos. DeepSeek.

DeepSeek-R1-Distill-Qwen-1,5B

DeepSeek-R1-Distill-Qwen-7B

DeepSeek-R1-Distill-Qwen-14B

Modelo vetorial

BGE-M3

O BGE-M3 é um modelo vetorial de uso geral compatível com recuperação densa, multivetorial e esparsa. Ele processa entradas de até 8.192 tokens e aceita mais de 100 idiomas naturais.

BGE-Large-zh-v1.5

O BGE Embedding é um modelo vetorial de uso geral pré-treinado com RetroMAE e treinado em dados pareados em larga escala usando aprendizado contrastivo.

Recursos dos serviços de modelos grandes

Implantação rápida

Uma interface visual guiada permite implantar modelos com pouco código. Crie e publique serviços de modelo com configuração mínima, sem necessidade de código de infraestrutura.

Comunicação interna segura

Os modelos são implantados em grupos de recursos totalmente gerenciados do DataWorks e utilizam PrivateLink e private zone para comunicação entre VPCs com isolamento de rede. Acesse o modelo pela rede interna da sua VPC.

  • Comunicação com isolamento de rede: O PrivateLink cria um canal dedicado entre sua VPC e a VPC do grupo de recursos do DataWorks, mantendo o tráfego fora da internet pública.

  • Resolução de nome de domínio privado: Uma private zone fornece DNS interno que encaminha automaticamente solicitações de nome de domínio para o serviço de modelo, permitindo acesso baseado em domínio a partir da sua VPC.

Conexão automatizada

Ao implantar um serviço de modelo em um grupo de recursos do DataWorks ou configurar uma VPC para ele, o sistema executa automaticamente as seguintes ações:

  1. Estabelece uma conexão entre VPCs: Cria um endpoint do PrivateLink na sua VPC e configura um canal criptografado para a VPC do grupo de recursos do DataWorks.

  2. Configure a resolução de nomes de domínio: Adiciona regras de encaminhamento de DNS na sua VPC para rotear solicitações ao serviço de modelo do DataWorks.

Fluxo de invocação do modelo

Ao chamar um serviço de modelo usando um nome de domínio:

  1. Análise da solicitação: A private zone resolve as solicitações de DNS da sua VPC para o IP privado da VPC do grupo de recursos do DataWorks.

  2. Encaminhamento de tráfego: O PrivateLink transmite a solicitação com segurança da sua VPC para a VPC do grupo de recursos do DataWorks.

  3. Resposta do serviço: A instância do modelo processa a solicitação e retorna o resultado da inferência.

Todo o processo ocorre em uma rede privada, sem exposição de IP público.

Implantação e uso do modelo

Selecione e implante modelos para uso em tarefas de desenvolvimento de dados:

  1. Implantar um modelo.

  2. Usar um modelo grande.