Ponte en Contacto
 Duración 14 horas

Temario del curso

Introducción a AIOps con herramientas de código abierto

  • Visión general de los conceptos y beneficios de AIOps.
  • Prometheus y Grafana en la pila de observabilidad.
  • El lugar del machine learning en AIOps: analítica predictiva vs. reactiva.

Configuración de Prometheus y Grafana

  • Instalación y configuración de Prometheus para la recopilación de series temporales.
  • Creación de tableros de control (dashboards) en Grafana utilizando métricas en tiempo real.
  • Exploración de exportadores, reetiquetado y descubrimiento de servicios.

Preprocesamiento de datos para Machine Learning

  • Extracción y transformación de métricas de Prometheus.
  • Preparación de conjuntos de datos para la detección de anomalías y predicción de tendencias.
  • Uso de transformaciones de Grafana o pipelines de Python.

Aplicación de Machine Learning para la Detección de Anomalías

  • Modelos básicos de ML para la detección de valores atípicos (p. ej., Isolation Forest, One-Class SVM).
  • Entrenamiento y evaluación de modelos con datos de series temporales.
  • Visualización de anomalías en los tableros de Grafana.

Predicción de métricas con Machine Learning

  • Construcción de modelos de predicción simples (ARIMA, Prophet, introducción a LSTM).
  • Predicción de la carga del sistema o el uso de recursos.
  • Uso de predicciones para alertas tempranas y decisiones de escalado.

Integración de Machine Learning con Alertas y Automatización

  • Definición de reglas de alertas basadas en la salida de ML o en umbrales.
  • Uso de Alertmanager y enrutamiento de notificaciones.
  • Disparo de scripts o flujos de trabajo de automatización ante la detección de anomalías.

Escalado y Operativización de AIOps

  • Integración de herramientas externas de observabilidad (p. ej., pila ELK, Moogsoft, Dynatrace).
  • Operativización de modelos de ML en pipelines de observabilidad.
  • Mejores prácticas para AIOps a gran escala.

Resumen y próximos pasos

Requerimientos

  • Comprensión de los conceptos de monitoreo de sistemas y observabilidad.
  • Experiencia en el uso de Grafana o Prometheus.
  • Familiaridad con Python y principios básicos de machine learning.

Audiencia

  • Ingenieros de observabilidad.
  • Equipos de infraestructura y DevOps.
  • Arquitectos de plataformas de monitoreo e ingenieros de confiabilidad de sitios (SRE).

Número de participantes


Precio por participante

Próximos cursos

Categorías Relacionadas