Quando jobs SQL grandes excedem a memória dedicada da sua instância ou quando a capacidade reservada fica ociosa durante a maior parte do dia, o Serverless Computing permite descarregar esses jobs para um pool de recursos isolado e sob demanda, sem afetar os recursos dedicados da sua instância.
O Serverless Computing está disponível para uso comercial a partir de 1º de julho de 2024, às 00:00 (UTC+8). Para detalhes sobre preços, consulte Visão geral do faturamento.
Como funciona
O Serverless Computing executa jobs SQL elegíveis em um pool de recursos completamente separado dos recursos dedicados da sua instância. Ao enviar um job, o Hologres provisiona automaticamente capacidade de computação isolada para ele. Após a conclusão do job, os recursos são liberados.

Este modelo de recursos possui três propriedades principais:
|
Propriedade |
O que isso significa para você |
|
Sob demanda |
Os recursos são alocados apenas enquanto o job está em execução. Você paga somente pelo que utiliza, sem cobrança por capacidade ociosa. |
|
Elástico |
O Serverless Computing processa jobs que, de outra forma, falhariam com erros de Out-of-Memory (OOM), executando-os em recursos isolados. |
|
Isolado |
Cada job roda em seu próprio ambiente, impedindo que uma consulta pesada afete o desempenho de outros jobs em execução. |
Quando usar o Serverless Computing
O Serverless Computing é ideal para três cenários:
Jobs SQL grandes que excedem a memória da instância
Caso a importação ou consulta de grandes conjuntos de dados cause erros OOM regularmente, o Serverless Computing executa esses jobs em recursos dedicados e isolados. Isso melhora as taxas de sucesso e protege a estabilidade da instância.
Capacidade reservada ociosa na maior parte do tempo
Se jobs grandes forem executados por menos de 16 horas diárias, você está pagando por capacidade reservada que permanece sem uso na maior parte do tempo. Reduza o tamanho da sua instância dedicada e direcione jobs pesados para recursos serverless, pagando apenas durante a execução desses jobs.
Picos de tráfego que sobrecarregam seus recursos dedicados
Direcione usuários específicos ou filas de consultas para recursos serverless durante períodos de pico. Essa estratégia alivia a demanda da sua instância dedicada sem impactar workloads sensíveis à latência que rodam nela.
Serverless Computing vs. recursos dedicados
O Serverless Computing e os recursos dedicados são complementares, não intercambiáveis. Utilize a tabela abaixo para decidir qual opção é mais adequada para cada tipo de workload.
|
Serverless Computing |
Recursos dedicados |
|
|
Compartilhamento de recursos |
Compartilhado entre todos os usuários na mesma zona. Pode haver enfileiramento durante picos de demanda. |
Totalmente reservado para sua instância. Sem disputa com outros usuários. |
|
Mais indicado para |
Processamento em lote e grandes consultas ad-hoc |
Workloads em tempo real e sensíveis à latência |
|
Workloads em tempo real |
Não suportado |
Necessário para operações em tempo real |
Limitações
O Serverless Computing não suporta workloads em tempo real. As seguintes operações devem ser executadas nos recursos dedicados da sua instância:
Ingestão de dados em tempo real via Flink, DataWorks ou Holo Client
Consultas pontuais imediatas usando Fixed Plan