Sono un Site Reliability/DevOps Engineer con oltre 4 anni di esperienza pratica nella creazione di infrastrutture scalabili senza interruzioni anche alle 3 di notte.
Ciò che ho effettivamente realizzato in produzione:
- Migrazioni AWS senza downtime (cambio di Elastic IP tra account, delega DNS Route53, riconfigurazione NLB) con automazione del rollback
- Pipeline CI/CD usando CDK/CodePipeline e GitHub Actions con scansione automatica della sicurezza
- Cluster EKS con storage FSx e disaster recovery, riducendo i tempi di inattività del 90%
- Monitoraggio CloudWatch/Prometheus che copre oltre 15 modalità di fallimento con logging strutturato e alerting multi-periodo
- Infrastruttura provisionata con Terraform per ambienti sicuri e ripetibili
- Automazioni personalizzate in Go e Python per orchestrazione infra (ad esempio, un layer proxy SFTP personalizzato)
Ciò che porto dai miei sistemi (costruiti e gestiti in modo indipendente):
- Piattaforme Kubernetes auto-riparanti con GitOps (ArgoCD), policy-as-code (Kyverno) e chaos engineering (AWS FIS) testate con un SLA di recupero di 10 minuti
- Rilevamento di sicurezza in runtime con Falco e risposta automatizzata e valutata in base alla severità
- Un operatore Kubernetes da zero (Go, CRD personalizzati, controller-runtime) per la gestione delle flotte
- Multi-cl