Благодарим ви, че изпратихте вашето запитване! Един от членовете на нашия екип ще се свърже с вас скоро.
Благодарим ви, че направихте своята резервация! Един от членовете на нашия екип ще се свърже с вас скоро.
Съдържание и теми, включени в курса
Проектиране на отворена AIOps архитектура
- Преглед на ключовите компоненти в отворените AIOps pipelines
- Поток на данни от поглъщане до известяване
- Сравнение на инструменти и стратегия за интеграция
Събиране и агрегиране на данни
- Поглъщане на данни от времеви редове с Prometheus
- Улавяне на логове с Logstash и Beats
- Нормализиране на данни за корелация между източници
Изграждане на табла за наблюдаемост
- Визуализиране на метрики с Grafana
- Изграждане на Kibana табла за анализ на логове
- Използване на Elasticsearch заявки за извличане на оперативни прозрения
Откриване на аномалии и прогнозиране на инциденти
- Експортиране на данни за наблюдаемост към Python pipelines
- Обучение на ML модели за откриване на отклонения и прогнозиране
- Внедряване на модели за инференция на живо в pipeline за наблюдаемост
Известяване и автоматизация с отворени инструменти
- Създаване на Prometheus правила за известяване и маршрутизиране чрез Alertmanager
- Задействане на скриптове или API работни процеси за автоматичен отговор
- Използване на инструменти за оркестрация с отворен код (напр. Ansible, Rundeck)
Съображения за интеграция и мащабируемост
- Справяне с поглъщане на голям обем данни и дългосрочно съхранение
- Сигурност и контрол на достъпа в стекове с отворен код
- Независимо мащабиране на всеки слой: поглъщане, обработка, известяване
Реални приложения и разширения
- Казуси: настройка на производителността, предотвратяване на прекъсвания и оптимизиране на разходите
- Разширяване на pipelines с инструменти за трасиране или графи на услугите
- Най-добри практики за управление и поддръжка на AIOps в производство
Обобщение и следващи стъпки
Изисквания
- Опит с инструменти за наблюдаемост като Prometheus или ELK
- Практически познания по Python и основите на машинното обучение
- Разбиране на ИТ операциите и работните процеси за известяване
Аудитория
- Инженери по надеждност на сайтове (SRE) на напреднало ниво
- Инженери по данни, работещи в операциите
- Водещи на DevOps платформи и архитекти на инфраструктура
14 Часа