-
Notifications
You must be signed in to change notification settings - Fork 1
[K8s] Adicionar HPA para escalonamento automático do stella-api #146
Copy link
Copy link
Open
Labels
k8sKubernetes / infraestrutura de produçãoKubernetes / infraestrutura de produçãoperformancePerformance, escalabilidade e eficiênciaPerformance, escalabilidade e eficiênciatriage:futuroBoa ideia, mas futura ou sem prioridade para a estrutura atualBoa ideia, mas futura ou sem prioridade para a estrutura atualtriage:superflua-agoraSupérflua para a estrutura atual, especialmente no GimliSupérflua para a estrutura atual, especialmente no Gimli
Description
Metadata
Metadata
Assignees
Labels
k8sKubernetes / infraestrutura de produçãoKubernetes / infraestrutura de produçãoperformancePerformance, escalabilidade e eficiênciaPerformance, escalabilidade e eficiênciatriage:futuroBoa ideia, mas futura ou sem prioridade para a estrutura atualBoa ideia, mas futura ou sem prioridade para a estrutura atualtriage:superflua-agoraSupérflua para a estrutura atual, especialmente no GimliSupérflua para a estrutura atual, especialmente no Gimli
Situação atual
O deployment do
stella-apiestá fixo emreplicas: 1. Não há escalonamento automático configurado.Por que adicionar HPA
Durante demonstrações de aula com múltiplos alunos usando o sistema simultaneamente, especialmente com features de IA (análise de foto, busca semântica), o pod único pode ficar sobrecarregado.
Um HPA simples baseado em CPU já resolve o caso de uso de demo:
Pré-requisitos
Impacto na aula
Excelente demonstração ao vivo:
kubectl get hpa -n platform -wNota sobre AiUsageGuard
Com HPA ativo, o
AiUsageGuardem memória passa a ter comportamento incorreto (issue #137). As duas issues devem ser tratadas em conjunto ou na sequência correta.