Esgotamento dos créditos de burst do disco na nuvem Burst credit depletion
ID da causa dk-burst · Responsável principal Infraestrutura de servidores (Equipe de infraestrutura) · Também envolvidos Infraestrutura de banco de dados (Equipe de infraestrutura)
Alguns discos na nuvem e instâncias pequenas têm créditos de burst, que permitem passar do desempenho base por um tempo; quando o período de uso intenso se prolonga e os créditos acabam, a velocidade cai de repente.
Por quê Uso acima do desempenho base por muito tempo → Efeito Os créditos de burst acabam e o desempenho despenca para o nível base → Na tela O lag começa toda noite, depois de algumas horas de pico
Responsável principal Infraestrutura de servidores (Equipe de infraestrutura) · Também envolvidos Infraestrutura de banco de dados (Equipe de infraestrutura)
O que fazer (Equipe de infraestrutura)
Servidores/SO: usar discos com desempenho garantido (gp3, IOPS provisionados), criar alerta de saldo de créditos, verificar também o limite de burst da largura de banda de disco da instância e os créditos de CPU. Servidores de BD: trocar também os discos do BD, incluindo BD gerenciado, por discos com desempenho garantido e criar alerta de saldo de créditos.
Números de referência
Um disco gp2 de 100 GB na AWS entrega 300 IOPS normalmente e 3.000 IOPS em burst e, com os créditos cheios, aguenta cerca de 30 minutos. O gp3 não usa créditos e entrega sempre 3.000. Os Premium SSD pequenos do Azure também fazem burst por até 30 minutos com créditos.
No gráfico
Achata ao bater no limite · IOPS, saldo de créditos de burst
Onde olhar
Ver no CloudWatch o BurstBalance do EBS (gp2, st1, sc1), o EBSIOBalance% e o EBSByteBalance% da instância (algumas instâncias com burst) e o CPUCreditBalance das instâncias burstable. No Azure, ver métricas de uso de créditos de burst, como Data Disk Used Burst IO Credits Percentage
Confirma se
A partir do momento em que o saldo cai para perto de 0, o IOPS (VolumeReadOps, VolumeWriteOps) achata no desempenho base, e VolumeQueueLength e o lag aumentam juntos. Começa depois de algumas horas seguidas de pico
Descarta se
Saldos todos folgados, mas IOPS achatado: limite fixo do volume ou da instância (dk-iops)
Como verificar
Ferramentas de infra (sem precisar do código do jogo)
Saiba mais
Mesmo com o disco em ordem, máquinas virtuais pequenas têm limite de burst na própria largura de banda de disco da instância (por exemplo, pelo menos 30 minutos por dia), e o gráfico fica com o mesmo formato. Servidores baratos que usam créditos de CPU também caem para o desempenho base quando os créditos acabam.
Fontes
Amazon EBS General Purpose SSD volumesAWS Desempenho base do gp2 de 3 IOPS por GiB (mínimo de 100), burst até 3.000 IOPS com créditos de I/O, 5,4 milhões de créditos garantem pelo menos 30 minutos. O gp3 não tem burst e entrega sempre 3.000 IOPS
Managed disk burstingMicrosoft Azure Premium SSD P20 ou menor tem burst baseado em créditos; com os créditos cheios, 30 minutos na velocidade máxima de burst
Amazon EBS-optimized instance typesAWS Algumas instâncias só mantêm o desempenho máximo de EBS por 30 minutos a cada 24 horas e depois voltam ao desempenho base
Amazon CloudWatch metrics for Amazon EBSAWS BurstBalance: saldo (%) de créditos de I/O do gp2 e de créditos de vazão do st1 e sc1; VolumeReadOps, VolumeWriteOps, VolumeQueueLength
CloudWatch metrics that are available for your instancesAWS EBSIOBalance% e EBSByteBalance%: saldo de créditos de EBS de algumas instâncias que fazem burst de 30 minutos a cada 24 horas; CPUCreditBalance: saldo de créditos de CPU das instâncias burstable
Disk metricsMicrosoft Azure Uso de créditos de burst de disco e de VM, como Data Disk Used Burst IO Credits Percentage (intervalos de 5 minutos)