Mulțumim pentru trimiterea solicitării! Un membru al echipei noastre vă va contacta în curând.
Mulțumim pentru trimiterea rezervării! Un membru al echipei noastre vă va contacta în curând.
Durata 14 ore
Schița de curs
Introducere în AIOps
- Ce este AIOps și de ce contează
- Monitorizare tradițională vs. observabilitate bazată pe AIOps
- Arhitectura AIOps și componentele cheie
Colectarea și normalizarea datelor operaționale
- Tipuri de date de observabilitate: metrici, loguri și trace-uri
- Ingestia datelor din surse multiple (servere, containere, cloud)
- Utilizarea agenților și exporterelor (Prometheus, Beats, Fluentd)
Corelarea datelor și detecția anomaliilor
- Corelarea seriilor temporale și metode statistice
- Utilizarea modelelor ML pentru detecția anomaliilor
- Detectarea incidentelor în sisteme distribuite
Alertare și reducerea zgomotului
- Proiectarea regulilor și pragurilor inteligente de alertare
- Suprimarea, deduplicarea și gruparea alertelor
- Integrarea cu Alertmanager, Slack, PagerDuty sau Opsgenie
Analiza cauzei principale și vizualizare
- Utilizarea dashboard-urilor pentru a vizualiza metrici și a detecta tendințe
- Explorarea evenimentelor și a cronologiilor pentru RCA
- Urmărirea problemelor pe mai multe niveluri cu instrumente de distributed tracing
Automatizare și remediere
- Declanșarea scripturilor sau workflow-urilor automatizate în urma incidentelor
- Integrarea cu sisteme ITSM (ServiceNow, Jira)
- Cazuri de utilizare: self-healing, scalare, redirecționarea traficului
Platforme AIOps open source și comerciale
- Prezentarea instrumentelor: Prometheus, Grafana, ELK, Moogsoft, Dynatrace
- Criterii de evaluare pentru selectarea unei platforme AIOps
- Demo și sesiune hands-on cu un stack selectat
Rezumat și pașii următori
Cerințe
- Înțelegerea conceptelor de operațiuni IT și monitorizare a sistemelor
- Experiență cu instrumente de monitorizare sau dashboard-uri
- Familiaritate cu formatele de bază ale logurilor și metricilor
Public țintă
- Echipe de operațiuni responsabile de infrastructură și aplicații
- Site Reliability Engineers (SREs)
- Echipe de monitorizare și observabilitate IT