blog
Artigos técnicos sobre cloud, Kubernetes, DevOps e infra em geral. Baseado em problemas reais de produção — sem tutorial de hello world.
Artigos publicados
Caso real de degradação em Nginx e PHP-FPM com Too many open files, upstream timed out, 5xx e CPU/load altos — sem transformar o primeiro erro encontrado em causa raiz.
Como uma automação usa Zabbix API, filtro por idade, deduplicação, contexto visual, TTS e n8n para transformar alarmes persistentes em notificações acionáveis.
Como organizei um toolkit de plantão no Termux com SSH, fzf, diagnósticos read-only, relatórios sanitizados e atalhos para investigar Linux, bancos, Docker e Nginx pelo celular.
Como ler diaginfo=valuecache e comparar memória configurada, usada, livre e quantidade de valores antes de aumentar ValueCacheSize por tentativa e erro.
Suíte de teste e2e criada especificamente pra verificar que a API rejeita token com secret errado, alg:none, payload adulterado, expirado e malformado — em vez de confiar que …
Como desenhei um toolkit interativo de operação AWS (Bash + fzf, 15+ módulos) que nunca deleta, purga ou remove nada — e a matriz de impacto que classifica toda ação antes dela …
Resize automático de instância OCI que sabe diferenciar 'sem capacidade agora' de 'erro de verdade' — retry interno com backoff, e uma fila externa via at/atd pra reagendar sem …
Checklist de alteração em produção pra um n8n em modo fila (Postgres + Redis + worker) — o maior risco operacional não é recriar containers, é remover volume sem querer.
O ansible.cfg do seu repo provavelmente não é o que roda em produção no Semaphore, become nunca é default, e a diferença entre 'Extra Variables' e 'Environment Variables' que não …