Gracias por enviar su consulta! Uno de los miembros de nuestro equipo se pondrá en contacto con usted en breve.
Gracias por enviar su reserva! Uno de los miembros de nuestro equipo se pondrá en contacto con usted en breve.
Duración 14 horas
Temario del curso
Introducción a AIOps con herramientas de código abierto
- Visión general de los conceptos y beneficios de AIOps.
- Prometheus y Grafana en la pila de observabilidad.
- El lugar del machine learning en AIOps: analítica predictiva vs. reactiva.
Configuración de Prometheus y Grafana
- Instalación y configuración de Prometheus para la recopilación de series temporales.
- Creación de tableros de control (dashboards) en Grafana utilizando métricas en tiempo real.
- Exploración de exportadores, reetiquetado y descubrimiento de servicios.
Preprocesamiento de datos para Machine Learning
- Extracción y transformación de métricas de Prometheus.
- Preparación de conjuntos de datos para la detección de anomalías y predicción de tendencias.
- Uso de transformaciones de Grafana o pipelines de Python.
Aplicación de Machine Learning para la Detección de Anomalías
- Modelos básicos de ML para la detección de valores atípicos (p. ej., Isolation Forest, One-Class SVM).
- Entrenamiento y evaluación de modelos con datos de series temporales.
- Visualización de anomalías en los tableros de Grafana.
Predicción de métricas con Machine Learning
- Construcción de modelos de predicción simples (ARIMA, Prophet, introducción a LSTM).
- Predicción de la carga del sistema o el uso de recursos.
- Uso de predicciones para alertas tempranas y decisiones de escalado.
Integración de Machine Learning con Alertas y Automatización
- Definición de reglas de alertas basadas en la salida de ML o en umbrales.
- Uso de Alertmanager y enrutamiento de notificaciones.
- Disparo de scripts o flujos de trabajo de automatización ante la detección de anomalías.
Escalado y Operativización de AIOps
- Integración de herramientas externas de observabilidad (p. ej., pila ELK, Moogsoft, Dynatrace).
- Operativización de modelos de ML en pipelines de observabilidad.
- Mejores prácticas para AIOps a gran escala.
Resumen y próximos pasos
Requerimientos
- Comprensión de los conceptos de monitoreo de sistemas y observabilidad.
- Experiencia en el uso de Grafana o Prometheus.
- Familiaridad con Python y principios básicos de machine learning.
Audiencia
- Ingenieros de observabilidad.
- Equipos de infraestructura y DevOps.
- Arquitectos de plataformas de monitoreo e ingenieros de confiabilidad de sitios (SRE).