Infraestrutura de produção. Primeiro entender. Depois mexer.
Sou o Castro. Trabalho com cloud, Linux, containers, bancos, observabilidade e automação em ambientes reais. Por aqui entram os casos que deram trabalho, o que foi feito e o que a evidência realmente permite concluir. Sem floreio e sem inventar causa pra fechar bonito.
Cases reais
Problemas atendidos na prática. Cliente não vira personagem e hipótese não vira causa só para a história ficar mais bonita.
Todos os cases →O MySQL voltou depois do reboot. A causa do incidente, não.
Um servidor MySQL deixou de responder, o SSH também parou e o reboot recuperou o ambiente. A investigação mostrou por que recuperação e causa raiz são coisas diferentes.
De playbooks concentrados a uma operação delegável: guardrails com Ansible e Semaphore
Case anonimizado: como playbooks e conhecimento operacional passaram a ser expostos como tarefas governadas, com risco, alvo, Survey, validação e critérios de escalonamento.
MongoDB HA em ambiente multicloud: operação, backup e continuidade
Case anonimizado: operação de MongoDB em ambiente AWS/GCP com alta disponibilidade, monitoramento, tuning, backup/restore e continuidade.
O que eu resolvo
Do incidente pontual à arquitetura. O foco é entender o ambiente, reduzir risco e deixar uma operação mais previsível depois da mudança.
Ver serviços →Troubleshooting
Incidentes de produção, timeouts, CPU, memória, rede, proxy, aplicação e causa raiz baseada em evidências.
↗ 02Cloud
AWS, OCI e GCP: arquitetura, redes, IAM, compute, storage, custos, auditoria e migrações.
↗ 03Containers & Kubernetes
Docker, Traefik, Nginx, OKE/EKS, GitOps, ingress, storage e workloads em produção.
↗ 04Bancos
PostgreSQL, MySQL/MariaDB, MongoDB e Redis: performance, disponibilidade, backup e migração.
↗ 05Observabilidade
Zabbix, Prometheus, Grafana, Loki, Dynatrace e PMM com foco em alertas acionáveis.
↗ 06Automação
Ansible, Shell, n8n e CI/CD para transformar operação manual em processo reproduzível.
↗Projetos e produtos
Ferramentas, automações, produtos e iniciativas que posso associar diretamente a Roberto Castro / CastroTI.
Todos os projetos →Ecossistema operacional com Ansible, Semaphore, n8n e Zabbix
Plataforma operacional própria que transforma playbooks, alertas e diagnósticos em operações governadas, com alvo explícito, classificação de risco, confirmação, rate limit e validação de …
CRM Lagos: SaaS multi-tenant para pequenos negócios
Projeto próprio de Castro: CRM para pequenos negócios com funil comercial, recorrência e automação de WhatsApp.
CastroOps: toolkit de operação e FinOps pelo terminal
Toolkit próprio de Castro para diagnóstico read-only, inventário, cloud e rotinas operacionais a partir do terminal.
Artigos técnicos
Logs, comandos, decisões e checklists. Conteúdo para quem está com o terminal aberto e precisa entender o que está acontecendo.
Todos os artigos →Primeiro entender.
Depois mudar.
Em produção, reiniciar pode recuperar serviço. Isso não transforma reboot em diagnóstico. A abordagem prioriza coleta read-only, evidência e mudança pequena, reversível e validada.
Metodologia e anonimização →- 01Coletarestado atual sem impacto
- 02Evidenciarlogs, métricas e contexto
- 03Diagnosticarfato separado de hipótese
- 04Corrigirmudança controlada
- 05Validarconfirmar resultado e documentar
Me chama de Castro.
Se o ambiente está degradando, migrando ou simplesmente difícil de entender, manda o cenário. Bora organizar as evidências antes de sair mexendo.