Struttura del corso
Fondamenti delle operazioni cloud su AWS
- Ruoli e responsabilità operative nel contesto cloud
- Struttura degli account AWS, organizzazioni e strategie multi-account
- I principali servizi operativi: CloudWatch, CloudTrail, AWS Config
Infrastructure as Code e provisioning dell’infrastruttura
- Principi fondamentali di IaC e della gestione di infrastrutture immutabili
- Provisioning mediante Terraform e AWS CloudFormation
- Gestione dello stato, dei moduli e delle fasi di promozione ambientale
CI/CD e strategie di distribuzione
- Progettazione di pipeline CI/CD per applicazioni cloud-native
- Strategie di deployment come blue/green, canary e rolling
- Automazione del rollback, dei controlli sanitari e della validazione delle release
Monitoraggio, osservabilità e allerta
- Metriche, log e tracce: come inviarli, archiviarli ed analizzarli
- Utilizzo di CloudWatch, X-Ray e altri strumenti di osservabilità third-party
- Definizione di SLO/SLI, politiche di notifica e pratiche relative al servizio di assistenza in caso di problemi
Sicurezza operativa e gestione delle identità
- Le migliori pratiche IAM, applicazione del principio del minimo privilegio e accesso tra account diversi
- Gestione delle credenziali sensibili, KMS e archivi sicuri per i parametri
- Sicurezza operativa: strategie di aggiornamento software, analisi delle vulnerabilità e tracciamento degli accessi
Resilienza, backup e ripristino in caso di disastri
- Progettazione orientata alla tolleranza ai guasti e all’alta disponibilità
- Strategie per i backup, automazione della creazione di snapshot e procedure di ripristino
- Pianificazione del ripristino in caso di disastri e redazione dei relativi playbook operativi
Ottimizzazione dei costi e governance infrastrutturale
- Trasparenza sui costi: fatturazione, attribuzione delle risorse e strategie di allocazione dei costi
- Ottimizzazione delle dimensioni delle risorse, utilizzo di istanze riservate e Savings Plans, nonché controlli per la gestione del budget
- Governance: definizione di policy, imposizione di limitazioni tecniche e automazione a tutela della conformità normativa
Container, architetture serverless e gestione dei runtime
- Considerazioni operative relative all’utilizzo di ECS, EKS e Lambda
- Rilevamento servizi, autoscaling e impostazione dei limiti delle risorse
- Registrazione log, tracciamento e diagnostica per i carichi di lavoro containerizzati
Gestione degli incidenti, playbook operativi e ingegneria del caos
- Procedure di risposta agli incidenti guidate dai playbook operativi e pratiche post-mortem efficaci
- Automatizzazione delle azioni correttive e implementazione di meccanismi auto-correttivi
- Introduzione all’utilizzo degli esperimenti di caos al fine di verificare la resilienza del sistema
Laboratorio pratico: gestione di un carico di lavoro di esempio
- Distribuzione di una applicazione campione tramite strumenti IaC e pipeline CI/CD
- Configurazione del monitoraggio, delle notifiche automatiche e dello script per la correzione dei problemi
- Simulazione di eventi critici e applicazione pratica delle procedure previste nei playbook operativi
Sintesi finale e prossimi passi
Requisiti
- Conoscenza di base dei concetti relativi al cloud e alla rete
- Familiarità con l’utilizzo della riga di comando Linux e con la scrittura di script
- Esperienza nell’uso del controllo versione (Git) e nozioni preliminari sui concetti CI/CD
Destinatari
- Ingegneri di operazioni cloud
- SRE e ingegneri di piattaforma
- Ingegneri DevOps e responsabili tecnici dei team
Recensioni (1)
Ho scoperto nuove e interessanti cose su Lambda e Serverless
Oleg Buldumac - PUBLIC COURSE
Corso - AWS Lambda for Developers
Traduzione automatica