↓Pular para o conteúdo principal
CAMPO / KNOWLEDGE BASE

blog

Artigos técnicos sobre cloud, Kubernetes, DevOps e infra em geral. Baseado em problemas reais de produção — sem tutorial de hello world.

Artigos publicados

11.08.2026 7 min
Too many open files, upstream timed out e CPU alta: analisando uma degradação sob concorrência

Caso real de degradação em Nginx e PHP-FPM com Too many open files, upstream timed out, 5xx e CPU/load altos — sem transformar o primeiro erro encontrado em causa raiz.

nginxphp-fpmlinux
→
11.08.2026 6 min
Transformando alertas brutos do Zabbix em incidentes acionáveis com n8n

Como uma automação usa Zabbix API, filtro por idade, deduplicação, contexto visual, TTS e n8n para transformar alarmes persistentes em notificações acionáveis.

zabbixn8nautomacao
→
11.08.2026 6 min
Transformando o celular em uma caixa de ferramentas DevOps para troubleshooting remoto

Como organizei um toolkit de plantão no Termux com SSH, fzf, diagnósticos read-only, relatórios sanitizados e atalhos para investigar Linux, bancos, Docker e Nginx pelo celular.

termuxdevopslinux
→
11.08.2026 5 min
Value Cache no Zabbix: como validar o sizing usando diaginfo=valuecache

Como ler diaginfo=valuecache e comparar memória configurada, usada, livre e quantidade de valores antes de aumentar ValueCacheSize por tentativa e erro.

zabbixvalue-cachediaginfo
→
08.08.2024 3 min
Não confie que sua lib de JWT funciona — teste alg:none, secret errado e token adulterado

Suíte de teste e2e criada especificamente pra verificar que a API rejeita token com secret errado, alg:none, payload adulterado, expirado e malformado — em vez de confiar que …

nestjsjwtsegurança
→
10.06.2024 3 min
Uma CLI de operação AWS sem nenhum delete: a matriz de risco que uso pra desenhar ferramenta interna

Como desenhei um toolkit interativo de operação AWS (Bash + fzf, 15+ módulos) que nunca deleta, purga ou remove nada — e a matriz de impacto que classifica toda ação antes dela …

awsbashcli
→
15.05.2024 2 min
Fila de retry pra falta de capacidade na OCI: distinguindo rc=3 de erro fatal

Resize automático de instância OCI que sabe diferenciar 'sem capacidade agora' de 'erro de verdade' — retry interno com backoff, e uma fila externa via at/atd pra reagendar sem …

ocibashautomação
→
28.04.2024 3 min
O antipattern do docker compose down -v: runbook de mudança segura num n8n com estado

Checklist de alteração em produção pra um n8n em modo fila (Postgres + Redis + worker) — o maior risco operacional não é recriar containers, é remover volume sem querer.

dockern8npostgresql
→
25.03.2024 3 min
Ansible via Semaphore: 4 armadilhas que dão erro silencioso, não crash

O ansible.cfg do seu repo provavelmente não é o que roda em produção no Semaphore, become nunca é default, e a diferença entre 'Extra Variables' e 'Environment Variables' que não …

ansiblesemaphoreautomação
→