Intrati in legatura

Schița de curs

Fundamentele operațiunilor cloud pe AWS

  • Roluri și responsabilități operaționale în cloud
  • Structura contului AWS, organizații și strategie multi-cont
  • Servicii operaționale de bază: CloudWatch, CloudTrail, AWS Config

Infrastructure as Code și provisionare

  • Principiile IaC și infrastructura imutabilă
  • Provisionare cu Terraform și AWS CloudFormation
  • Gestionarea stării, modulelor și promovarea mediilor

CI/CD și strategii de deployment

  • Proiectarea pipeline-urilor CI/CD pentru aplicații cloud-native
  • Deployment-uri blue/green, canary și rolling
  • Automatizarea rollback-ului, health check-urilor și validării release-urilor

Monitoring, observabilitate și alertare

  • Metrici, log-uri și trace-uri: colectare, stocare și analiză
  • Utilizarea CloudWatch, X-Ray și a instrumentelor de observabilitate third-party
  • Definirea SLO-urilor/SLI-urilor, a politicilor de alertare și a practicilor on-call

Operațiuni de securitate și managementul identității

  • Bune practici IAM, principiul celui mai mic privilegiu și acces cross-account
  • Gestionarea secretelor, KMS și stocare securizată a parametrilor
  • Securitate operațională: strategii de patching, scanare de vulnerabilități și piste de audit

Reziliență, backup și disaster recovery

  • Proiectare pentru toleranță la erori și disponibilitate ridicată
  • Strategii de backup, automatizarea snapshot-urilor și proceduri de restore
  • Planificarea disaster recovery și crearea de runbook-uri

Optimizarea costurilor și guvernanță

  • Vizibilitatea costurilor: strategii de facturare, tagging și alocare a costurilor
  • Rightsizing, instanțe rezervate/savings plans și controale bugetare
  • Guvernanță: politici, guardrails și automatizare pentru conformitate

Containere, serverless și operațiuni de runtime

  • Considerații operaționale pentru ECS, EKS și Lambda
  • Service discovery, autoscaling și limite de resurse
  • Logging, tracing și debugging pentru workload-uri containerizate

Răspuns la incidente, playbook-uri și chaos engineering

  • Răspuns la incidente bazat pe runbook-uri și practici de postmortem
  • Automatizarea remedierii și pattern-uri de self-healing
  • Introducere în experimente de chaos pentru validarea rezilienței

Workshop practic: Operarea unui workload de probă

  • Deploy-uirea unei aplicații de probă folosind IaC și un pipeline CI/CD
  • Implementarea monitoring-ului, alertelor și a unui script de remediere automată
  • Simularea incidentelor și exersarea răspunsului bazat pe runbook-uri

Rezumat și pașii următori

Cerințe

  • O înțelegere de bază a conceptelor cloud și de networking
  • Familiaritate cu linia de comandă Linux și scripting
  • Experiență cu versionarea codului (Git) și concepte de bază CI/CD

Public țintă

  • Ingineri de operațiuni cloud
  • SRE și ingineri de platformă
  • Ingineri DevOps și lideri tehnici de echipă
 21 Ore

Numărul de participanți


Pret per participant

Mărturii (1)

Cursuri viitoare

Categorii înrudite