Configurerò il monitoraggio e gli avvisi di prometheus grafana per i tuoi server
AWS DevOps e SRE, 7 anni, Kubernetes CKA, Terraform, CICD
Informazioni su questo servizio
Scoprire che il tuo server era giù da un cliente non è il modo giusto di scoprirlo. Lascia che configuri un monitoraggio che te lo dica prima.
Senior DevOps / SRE, oltre 7 anni a Zoom, Airtel, Infosys e Mindtree. Gestisco il servizio di on-call per più di 150 host Linux e multi-cluster EKS con un uptime superiore al 99%, usando Prometheus, Grafana, Datadog e PagerDuty ogni giorno. Certificato: CKA, AWS Solutions Architect, AWS SysOps, Terraform.
COSA CONFIGURO
Prometheus con node exporter, cAdvisor e service exporters
Dashboard di Grafana che mostrano ciò che conta davvero, non 40 pannelli inutili
Regole di Alertmanager indirizzate a Slack, email o PagerDuty
Loki per log centralizzati, ricercabili accanto ai tuoi metric
Monitoraggio di Kubernetes: pod, nodi, deployment, pressione delle risorse
Allarmi di AWS CloudWatch dove sono più adatti rispetto a Prometheus
PERCHÉ È IMPORTANTE
Gli alert che scattano continuamente vengono ignorati. Regolo le soglie in modo che ogni alert significhi davvero che qualcosa non va e necessita di un intervento umano.
COME LAVORO
Passo uno: dimmi cosa gestisci e cosa ti ha causato problemi prima.
Passo due: confermo l'ambito e cosa deve attivare l'alert. La consulenza è gratuita.
Passo tre: stack funzionante, alert tarati e un runbook per ogni alert.
Scrivimi con il tuo setup per una consulenza gratuita.
Strumenti:
Docker
•
Kubernetes
•
Amazon EKS
•
Altro
Framework:
Terraform
•
Ansible
Provider Cloud:
Amazon Web Services
Linguaggio di programmazione:
Bash
•
Python
Expertise:
Installazione
•
Debug
•
Configurazione

