Autoescalonamento vertical está disponível nos planos Scale e Enterprise. Para fazer upgrade, acesse a página de planos no Console do Cloud.
Os serviços dos níveis Scale e Enterprise com perfis padrão 1:4 oferecem suporte ao autoescalonamento com base no uso de CPU e memória. O uso do serviço é monitorado continuamente durante uma janela de análise para orientar as decisões de escalonamento. Se o uso subir acima ou cair abaixo de determinados limites, o serviço será escalado adequadamente para acompanhar a demanda.
Configurando o autoescalonamento vertical
Membros da organização com a função Admin podem configurar o autoescalonamento vertical para serviços Scale e serviços Enterprise com perfis padrão 1:4. Acesse a aba Settings do seu serviço e ajuste a memória mínima e máxima, juntamente com as configurações de CPU, como mostrado abaixo. Serviços Enterprise com perfis personalizados exigem redimensionamento vertical com assistência do suporte.

Defina a memória máxima das suas réplicas com um valor maior que o da memória mínima. O serviço será então escalonado conforme necessário dentro desses limites. Essas configurações também estão disponíveis durante o fluxo inicial de criação do serviço. Cada réplica do seu serviço receberá os mesmos recursos de memória e CPU.
Você também pode optar por definir esses valores como iguais, basicamente "fixando" o serviço em uma configuração específica. Ao fazer isso, o escalonamento será imediatamente forçado para o tamanho desejado.
É importante observar que isso desativará qualquer autoescalonamento no cluster, e seu serviço não ficará protegido contra aumentos no uso de CPU ou memória além dessas configurações.