skie.io
Sage for AWS

Decisões de custo tomadas em conjunto

O Sage é o motor de otimização de custos da skie para AWS. Ele redimensiona seus recursos, do compute às bases de dados e ao armazenamento, planeja quais compromissos comprar e concilia os dois em uma única passagem, porque mudar um altera a resposta do outro. Depois aplica as mudanças para você, dentro de uma janela de manutenção que você já aprovou.

Solicite uma avaliação gratuita

Quem implementa as recomendações?

A maioria das ferramentas entrega uma lista e deseja boa sorte. Essas listas ficam intocadas por meses e quase nunca é por discordância. Redimensionar uma instância significa pará-la e iniciá- la de novo, e ninguém quer abrir uma janela de mudança apenas para economizar. O Sage elimina esse problema ao vincular a mudança a uma janela que você já executa.

  1. Etapa 1

    O Sage recomenda

    Uma execução de redimensionamento produz a mudança de tipo de instância proposta, com recurso, conta e região anexados.

  2. Etapa 2

    Uma ação é agendada

    A mudança vira uma ação rastreada, programada para aplicar no próximo patch do sistema operacional. A indisponibilidade já está prevista, então o redimensionamento não custa nada a mais em risco ou coordenação.

  3. Etapa 3

    O Guardian executa

    O skie Guardian realiza a mudança durante a janela de patch, junto com a manutenção que você faria de qualquer forma.

  4. Etapa 4

    O resultado retorna

    O resultado é gravado na recomendação, com data, hora e status. Ações aplicadas, pendentes e canceladas são contabilizadas, e as falhas continuam visíveis em vez de sumirem.

Registro de uma ação de otimização concluída para mudar o tipo de instância, com o status aplicado, o identificador da instância, a região, o tipo antes e depois da mudança, e as datas de criação e conclusão.
Cada ação deixa um registro. Esta foi criada em 13 de agosto e concluída em 15 de agosto. Não foi executada sob demanda, esperou a janela de patch da conta. O nome da conta está oculto aqui porque o ambiente pertence a um cliente; nada mais neste registro foi alterado.

A implementação automatizada já está disponível para EC2, RDS e EBS. Os ambientes onde ela roda incluem instâncias produtivas de SAP S/4HANA e de bancos de dados HANA.

Por que otimizar EC2, ECS e EKS em conjunto?

Savings Plans e Reserved Instances são compartilhados entre EC2, ECS e EKS. Otimize qualquer um deles isoladamente e você erra nos outros dois. O Sage resolve os três em uma única execução, de modo que o plano de compromissos reflete o footprint que você realmente terá depois do redimensionamento, e não o de hoje.

Como isso aparece em uma única execução de otimização.
O que a execução fazPor que importa
Reduz o gasto de redimensionamento e aumenta o gasto com compromissos no mesmo planoRedimensionar muda o formato do seu consumo, então a posição de compromisso correta muda junto. Às vezes o total mais barato significa comprar mais compromisso, não menos. Uma ferramenta que trata os dois separadamente não chega a essa resposta.
Aumenta um node group enquanto esvazia outrosConsolidar cargas de trabalho em menos node groups, melhor ajustados, pode significar crescer um deles. O total cai mesmo com uma linha subindo.
Sinaliza Reserved Instances e Savings Plans como supercomprometidosO Sage avisa quando você está comprometido além do consumo que consegue cobrir, conciliando cada compromisso individual com sua utilização mensal medida. É o oposto do incentivo habitual de vender mais compromisso.
Trata o EKS como uma frotaOs node groups são dimensionados por nós, núcleos e memória em conjunto, não instância por instância, que é a única forma de as contas fecharem no Kubernetes.
Mostra a cobertura de reserva ao lado de cada propostaNunca se recomenda um redimensionamento sem mostrar o que cobre a instância atual. Esse é o problema das decisões desconectadas que encarece os custos quando as ferramentas trabalham isoladas.
Análise de custos de uma execução de otimização do Sage, com o custo mensal atual e otimizado detalhado em ECS sob demanda, reserved instances, savings plans e nós do EKS, com uma linha de total.
Uma execução, quatro componentes de custo. O redimensionamento derruba a linha de nós do EKS enquanto o gasto com savings plans sobe, porque a posição de compromisso correta mudou junto com o footprint. O total cai mesmo com duas linhas subindo.
Painel de cobertura de compromissos com reserved instances e savings plans, cada um com o valor mensal comprometido, o consumo que cobre e um aviso de supercompromisso.
O Sage avisa quando você se comprometeu demais. As duas posições aparecem sinalizadas como supercomprometidas frente ao consumo medido, conciliadas compromisso a compromisso.
Tabela de recomendações de node groups do EKS com node group, cluster, conta, mudança de tipo de instância e mudança na quantidade de nós, com etiquetas de acionável e sem mudança.
Algumas coisas crescem para que o total caia. Um node group passa de um nó para dois enquanto dois grupos autogerenciados se esvaziam por completo. Os node groups que o otimizador decidiu não mexer continuam na lista, marcados como sem mudança.
Resumo do redimensionamento da frota do EKS com quantidade de nós, núcleos e memória antes e depois da otimização, cada um com a redução e o percentual.
O Kubernetes é dimensionado como uma frota. Nós, núcleos e memória se movem juntos, não instância por instância.

Isso cobre apenas compute?

Não. Bases de dados e armazenamento são otimizados do mesmo jeito e têm seus próprios instrumentos de compromisso, em vez de pegar emprestado o modelo de compute. Uma execução de banco de dados abrange RDS, Aurora e DynamoDB em uma única passagem, pesando reserved instances e database savings plans junto com as mudanças de tamanho que está propondo ao mesmo tempo.

Análise de custos de uma execução de otimização de bancos de dados, com uma tabela de cinco componentes de custo cobrindo reserved instances, custo sob demanda, armazenamento do Aurora, database savings plan e DynamoDB sob demanda, cada um antes e depois.
Uma execução, cinco componentes de custo. O gasto sob demanda em bancos de dados cai enquanto o de reserved instances e savings plans sobe para compensar, o sob demanda do DynamoDB vai a zero e o armazenamento do Aurora fica intacto porque ali não há nada a ganhar. O mesmo trade-off do compute, com instrumentos próprios de banco de dados.
Dois painéis: a mudança de custo dividida em economia por redimensionamento, um aumento menor no gasto com compromissos e uma categoria menor adicional, e a mudança líquida nas famílias de instâncias de banco de dados, com quatro famílias novas crescendo e cinco antigas encolhendo.
Redimensionar não é só diminuir coisas. As famílias de instâncias mais antigas caem enquanto sobem as de nova geração, incluindo as baseadas em ARM. A maior parte da economia aqui vem de mover os bancos de dados para hardware melhor, não de rodá-los menores.

Como saber em que pé você está?

Duas medidas, e elas respondem perguntas diferentes. Uma diz o quanto seu compute está bem dimensionado. A outra diz o quanto esse compute está coberto e o que você paga sem usar. As duas são acompanhadas continuamente, então a resposta é um número e não uma opinião.

As máquinas estão no tamanho certo?

Percentuais brutos de CPU enganam em uma frota mista, porque uma instância pequena ocupada e uma grande ociosa não pesam igual. O Sage normaliza isso: cada tipo de instância é ponderado pela sua capacidade de compute relativa e a utilização é medida na faixa p90 a p99 em vez da média, para que picos curtos não fiquem escondidos por longos períodos calmos. O resultado é um número único para todo o ambiente.

Resumo de utilização ponderada por capacidade com percentuais de p90 a p99 para todo o histórico e para o mês anterior, cada um com classificação de bem utilizado, acima de um gráfico de tendência de seis meses dos mesmos quatro percentis.
Um indicador de redimensionamento para todo o ambiente. Percentis de todas as contas conectadas, o mês anterior ao lado para comparar e seis meses de tendência para ver se a disciplina de dimensionamento se mantém ou está se perdendo.

Esse compute está realmente coberto?

Redimensionar muda o que você precisa cobrir, então a cobertura tem de ser lida contra o footprint já dimensionado e não contra o original. Junto disso, o Sage acompanha os compromissos que você paga sem usar e quando os atuais vencem.

Quatro gráficos: compromissos não utilizados por mês em dólares, gasto não utilizado como percentual do equivalente sob demanda, e o valor de reserved instances e savings plans que vencem em cada mês futuro.
Desperdício e vencimentos, acompanhados todo mês. A linha de cima é compromisso que você paga sem usar, em dólares e como percentual do gasto. A de baixo é quando suas reserved instances e savings plans atuais acabam, o que determina quando cai a próxima decisão de compra.

O que você recebe na prática?

Três entregáveis concretos em cada execução, todos exportáveis.

  • Recomendações de redimensionamento

    Por recurso: o tipo de instância atual e o proposto, a conta e a região, um score de eficiência antes e depois, e a cobertura de compromisso já associada a ele. Os recursos que devem ficar como estão são marcados assim, em vez de sumirem da lista.

  • Um plano de compra de compromissos

    Itens que você pode executar: região, família de instância, plataforma, prazo, opção de pagamento, valor por hora e custo anual, distribuídos entre Instance Savings Plans, Compute Savings Plans e Convertible Reserved Instances.

  • Uma estimativa honesta de interrupção

    Quantas instâncias mudariam de família ou de quantidade de vCPU se você executar o plano. O custo de agir é declarado desde o início, não descoberto depois.

Como funciona o otimizador de compromissos

O Sage planeja os compromissos como um portfólio em um horizonte de três anos, trimestre a trimestre, usando programação linear inteira mista. É um solver, não um conjunto de regras de bolso, e por isso consegue equilibrar os instrumentos entre si em vez de aplicá-los um a um.

StepO que acontece
Primeiro os compromissos existentesAs Reserved Instances e os Savings Plans que você já tem são modelados como cobertura fixa que vence no próprio calendário. Tudo o que o Sage propõe é incremental sobre o que você já possui.
Cobertura trimestre a trimestreA demanda é coberta ao longo de doze trimestres. Cada trimestre mostra qual fonte cobre o quê e o que fica descoberto a preços sob demanda.
Três cenários precificadosO que você pagaria sem nenhum compromisso, quanto custa o seu mix atual e quanto custa o plano otimizado. As economias sempre são expressas contra uma linha de base declarada, não como um percentual solto.
Execuções versionadasCada execução é guardada como um snapshot datado, de modo que os planos podem ser comparados ao longo do tempo e uma decisão pode ser rastreada até o estado em que foi tomada.
Detalhamento de custos do portfólio de compromissos comparando três cenários em três anos: sem compromissos, mix atual e plano otimizado, com as economias expressas contra cada linha de base e o valor que permanece sob demanda.
As economias sempre têm uma linha de base declarada. Três cenários precificados em três anos, com o delta acionável frente ao seu mix atual informado separadamente do potencial total frente a não ter compromisso nenhum.

Quais serviços da AWS o Sage cobre?

O Sage analisa e otimiza um conjunto focado de serviços e dá visibilidade sobre um ambiente muito mais amplo. A distinção é deliberada. A otimização profunda é aplicada onde ela se paga.

ServiçoProfundidadeO que o Sage faz
EC2OtimizadoRedimensionamento e troca de tipo, planejamento de compromissos, implementação automatizada
ECSOtimizadoIncluído na resolução compartilhada de compromissos de compute
EKSOtimizadoDimensionamento de frota de node groups por nós, núcleos e memória, mais a resolução compartilhada de compromissos
RDSOtimizadoRedimensionamento, planejamento de reserved instances, implementação automatizada
EBSOtimizadoOtimização de tipo e tamanho de volume, implementação automatizada
ElastiCacheOtimizadoRedimensionamento e planejamento de nós reservados
OpenSearchOtimizadoRedimensionamento e planejamento de reserved instances
S3, EFS, FSxVisibilidadeInventário, atribuição de gasto e relatórios
DynamoDB, Redshift, TimestreamVisibilidadeInventário, atribuição de gasto e relatórios
Load balancers, NAT gateways, elastic IPsVisibilidadeInventário e atribuição de gasto, com relatório de recursos ociosos
Painel de gasto da AWS com o gasto total, sob demanda e comprometido do mês com indicadores de tendência, um detalhamento do mês anterior por serviço, e históricos de gasto de dezoito meses por serviço, região e conta.
A camada de visibilidade sobre a qual o Sage trabalha. Gasto total, sob demanda e comprometido com a variação mês a mês, o mês anterior detalhado por serviço e dezoito meses de histórico por serviço, região e conta. As decisões de otimização valem o que vale a foto de gasto que está por baixo.

Perguntas frequentes

O Sage faz mudanças na minha infraestrutura automaticamente?

Só onde você permitir, e só dentro de uma janela de manutenção que você controla. As mudanças em EC2, RDS e EBS viram ações agendadas que o Guardian aplica durante a sua próxima janela de patch. Cada ação guarda um registro com o que mudou, quando e se deu certo.

Ele vai recomendar redimensionar algo que está sob uma reserva?

Cada proposta de redimensionamento mostra a cobertura de compromisso do recurso a que se aplica, e o plano de compromissos é resolvido contra o footprint posterior ao redimensionamento. Essa conexão é justamente o motivo de fazer uma única passagem sobre o compute em vez de otimizar cada serviço isoladamente.

O Sage pode me dizer que comprei compromisso demais?

Sim. As Reserved Instances e os Savings Plans são conciliados contra a utilização medida, e as posições supercomprometidas são sinalizadas. Cada compromisso individual é listado com seu compromisso mensal frente ao consumo mensal.

Funciona com Kubernetes?

Os node groups do EKS são dimensionados como uma frota, considerando quantidade de nós, núcleos e memória em conjunto, e o EKS compartilha com EC2 e ECS a resolução de compromissos de compute.

Contra qual linha de base as economias são medidas?

O Sage precifica três cenários: sem nenhum compromisso, o seu mix atual e o plano otimizado. As economias sempre são expressas contra um deles e não como um percentual sem origem.

Com que frequência ele roda?

As otimizações podem ser executadas sob demanda ou em lotes, e cada execução é guardada como um snapshot datado para comparar planos ao longo do tempo. Análises com mais de trinta dias são marcadas como desatualizadas.

Veja o que o Sage encontra na sua conta

Uma avaliação gratuita roda sobre o seu consumo real e devolve as mesmas recomendações de redimensionamento, o plano de compromissos e a estimativa de interrupção descritos nesta página.

Solicite uma avaliação gratuita