blog
Artigos técnicos sobre cloud, Kubernetes, DevOps e infra em geral. Baseado em problemas reais de produção — sem tutorial de hello world.
Artigos publicados
Como tratar Out of host capacity como condição retryable em resize OCI com janela operacional, locks, limite de tentativas e validação explícita do resultado.
Como construir seleção de perfis AWS usando aws configure list-profiles, validar identidade com sts get-caller-identity e tratar region/source_profile sem parsing frágil.
Como preservar comportamento e descobrir ativos, legados, duplicidades, riscos e dependências antes de mover playbooks para uma estrutura mais bonita.
Como flock evita duas execuções concorrentes de scripts operacionais e por que lock, estado e tempo limite precisam fazer parte do desenho da automação.
Como separar CPU, I/O, waits, queries concorrentes e dead tuples em PostgreSQL antes de concluir que a solução é aumentar o servidor.
Como validar um WordPress em domínio temporário e automatizar a promoção para o domínio definitivo atualizando Traefik, home, siteurl e URLs no banco.
Como separar DNS, rota, TCP 10051, modo ativo e configuração do frontend quando um Zabbix Proxy não consegue conversar com o Server.
Como a ordem de source pode redefinir silenciosamente funções Bash, fazer menus perderem itens e criar bugs que só aparecem no plantão.
Como agrupar eventos de Auto Scaling em uma janela, validar o estado atual da AWS e só então decidir se o NOC precisa receber uma notificação.