Postagens

Mostrando postagens com o rótulo Infraestrutura

Entendendo Instâncias T3 Burstáveis: CPU Credits e Por Que Seu Servidor Fica Lento

Você sobe uma instância T3 para um ambiente de staging, tudo funciona bem por horas — até que, do nada, a CPU trava em 5% e a aplicação começa a responder com latência absurda. Sem erro no log, sem alarme disparado, sem explicação óbvia. Esse é o comportamento clássico de esgotamento de créditos de CPU em instâncias T3, e entender o mecanismo por trás disso é o que separa um diagnóstico de 5 minutos de horas de investigação inútil. TL;DR: Instâncias T3 e CPU Credits Conceito Comportamento CPU Credit Unidade que permite uso de CPU acima da baseline por 1 minuto Baseline de CPU Percentual garantido de CPU por tipo de instância (ex: t3.micro = 10%) Acúmulo de créditos Créditos acumulam quando CPU fica abaixo da baseline Esgotamento CPU é limitada à baseline quando créditos acabam (modo Standard) Modo Un...

NAT Gateway vs NAT Instance: Qual Usar para Instâncias Privadas Acessarem a Internet?

Você acabou de subir um cluster de instâncias privadas e percebe que o yum update trava — sem rota de saída para a internet. A pergunta imediata é: NAT Gateway gerenciado ou uma instância EC2 fazendo NAT? A escolha errada aqui aparece tarde, geralmente quando o tráfego aumenta ou quando você precisa escalar e descobre que a solução escolhida não acompanha. TL;DR — NAT Gateway vs NAT Instance Critério NAT Gateway NAT Instance (EC2) Gerenciamento Totalmente gerenciado pela AWS Você opera, patcha e monitora Alta disponibilidade Redundância interna por AZ Você implementa com Auto Scaling + script Escalabilidade Automática até limites do serviço Limitada pelo tipo de instância EC2 Custo base Cobrança por hora + por GB processado Custo da instância EC2 + EIP Security Gro...

Executando Scripts na Inicialização do EC2: Guia Completo de User Data

Você acabou de criar uma AMI base e precisa que cada nova instância já suba com Nginx instalado, configurado e rodando — sem intervenção manual. O recurso que resolve isso é o EC2 User Data , e entender exatamente onde ele executa, quando falha silenciosamente e quais armadilhas existem na prática faz toda a diferença entre um bootstrap confiável e horas de depuração. TL;DR — Resumo Rápido Ponto Detalhe O que é User Data Script shell (ou cloud-init) executado pelo cloud-init na primeira inicialização da instância Quando executa Por padrão, apenas uma vez — no primeiro boot após o lançamento Onde colar o script Console AWS → EC2 → Launch Instance → seção 'Advanced Details' → campo 'User data' Log de execução /var/log/cloud-init-output.log na instância Permissão de execução O script roda como root — sem necessidade de sudo Limite de tamanho 16 KB (em texto puro); scripts maiores...

Conectando Duas VPCs com VPC Peering: Guia Completo de Configuração e Tabelas de Rotas

Você tem duas VPCs na mesma conta e região, e os recursos precisam se comunicar usando IPs privados — sem passar pela internet pública. O VPC Peering é a solução nativa da AWS para isso, mas a armadilha clássica é criar a conexão de peering e achar que está pronto. Sem atualizar as tabelas de rotas e os security groups em ambos os lados, o tráfego simplesmente não flui. TL;DR — Conectando Duas VPCs com VPC Peering Etapa O que fazer Onde 1 Criar a solicitação de peering VPC-A (solicitante) 2 Aceitar a solicitação de peering VPC-B (aceitante) 3 Adicionar rota na tabela de rotas da VPC-A apontando para o CIDR da VPC-B Route table da VPC-A 4 Adicionar rota na tabela de rotas da VPC-B apontando para o CIDR da VPC-A Route table da VPC-B 5 Atualizar security groups para permitir tráfego do CIDR remoto Instâncias em ambas as VPCs Como o VPC Peering Funciona O VPC Peering cria uma conexão de rede priv...

Health Checks no Auto Scaling Group: EC2 vs ELB — Quando Trocar e Como Diagnosticar Terminações Inesperadas

Seu Auto Scaling Group está terminando instâncias que parecem saudáveis no console EC2 — o status mostra running , o sistema operacional responde ao SSH, mas o ASG insiste em substituí-las. Esse comportamento quase sempre aponta para uma divergência entre o tipo de health check configurado e o que a aplicação realmente precisa para ser considerada saudável. TL;DR — Auto Scaling Group Health Check: EC2 vs ELB Aspecto EC2 (padrão) ELB O que verifica Status do hipervisor e hardware Resposta HTTP/TCP da aplicação Quando usar Workloads sem load balancer Instâncias registradas em Target Group Instância 'running' mas app travada Considerada saudável Considerada unhealthy → terminada Risco principal Servir tráfego com app quebrada Terminações em cascata se health check mal configurado Grace period Aplica-se a ambos Aplica-se a ambos Como os Health Checks do ASG Funcionam O ASG avalia a saúde d...