Mulțumim pentru trimiterea solicitării! Un membru al echipei noastre vă va contacta în curând.
Mulțumim pentru trimiterea rezervării! Un membru al echipei noastre vă va contacta în curând.
Durata 14 ore
Schița de curs
Introducere în AIOps
- Ce este AIOps și de ce contează
- Monitorizare tradițională vs. observabilitate bazată pe AIOps
- Arhitectura AIOps și componentele cheie
Colectarea și Normalizarea Datelor Operaționale
- Tipuri de date de observabilitate: metrici, loguri și trace-uri
- Ingestia datelor din surse multiple (servere, containere, cloud)
- Utilizarea agenților și a exporterelor (Prometheus, Beats, Fluentd)
Corelarea Datelor și Detectarea Anomaliilor
- Corelarea seriilor temporale și metode statistice
- Utilizarea modelelor ML pentru detectarea anomaliilor
- Detectarea incidentelor în sisteme distribuite
Alertare și Reducerea Zgomotului
- Proiectarea regulilor inteligente de alertare și a pragurilor
- Suprimarea, deduplicarea și gruparea alertelor
- Integrarea cu Alertmanager, Slack, PagerDuty sau Opsgenie
Analiza Cauzei Rădăcină și Vizualizare
- Utilizarea dashboard-urilor pentru a vizualiza metrici și a detecta tendințe
- Explorarea evenimentelor și a cronologiilor pentru RCA
- Urmărirea problemelor pe mai multe niveluri cu instrumente de distributed tracing
Automatizare și Remediere
- Declanșarea scripturilor sau workflow-urilor automatizate în urma incidentelor
- Integrarea cu sisteme ITSM (ServiceNow, Jira)
- Use case-uri: self-healing, scaling, rerutarea traficului
Platforme AIOps Open Source și Comerciale
- Prezentare generală a instrumentelor: Prometheus, Grafana, ELK, Moogsoft, Dynatrace
- Criterii de evaluare pentru selectarea unei platforme AIOps
- Demo și hands-on cu un stack selectat
Rezumat și Pașii Următori
Cerințe
- Înțelegerea conceptelor de operațiuni IT și monitorizare a sistemelor
- Experiență cu instrumente de monitorizare sau dashboard-uri
- Familiaritate cu formate de bază de loguri și metrici
Audiență
- Echipe de operațiuni responsabile de infrastructură și aplicații
- Site Reliability Engineers (SREs)
- Echipe de monitorizare IT și observabilitate