Temario del curso
Introducción a las Operaciones de Kubernetes Mejoradas con IA
- Por qué la IA es importante para las operaciones modernas de clúster
- Limitaciones de la lógica tradicional de escalado y programación
- Conceptos clave de ML para la gestión de recursos
Fundamentos de la Gestión de Recursos en Kubernetes
- Fundamentos de la asignación de CPU, GPU y memoria
- Comprensión de cuotas, límites y solicitudes
- Identificación de cuellos de botella e ineficiencias
Enfoques de Aprendizaje Automático para la Programación
- Modelos supervisados y no supervisados para la colocación de cargas de trabajo
- Algoritmos predictivos para la demanda de recursos
- Uso de características de ML en programadores personalizados
Aprendizaje por Refuerzo para el Autoscaling Inteligente
- Cómo los agentes de RL aprenden del comportamiento del clúster
- Diseño de funciones de recompensa para la eficiencia
- Creación de estrategias de autoscaling impulsadas por RL
Autoscaling Predictivo con Métricas y Telemetría
- Uso de datos de Prometheus para el pronóstico
- Aplicación de modelos de series temporales al autoscaling
- Evaluación de la precisión de las predicciones y ajuste de modelos
Implementación de Herramientas de Optimización Impulsadas por IA
- Integración de marcos de ML con controladores de Kubernetes
- Despliegue de bucles de control inteligentes
- Extensión de KEDA para la toma de decisiones asistida por IA
Estrategias de Optimización de Costos y Rendimiento
- Reducción de costos de cómputo mediante el escalado predictivo
- Mejora de la utilización de GPU mediante la colocación impulsada por ML
- Equilibrio entre latencia, throughput y eficiencia
Escenarios Prácticos y Casos de Uso en el Mundo Real
- Autoscaling de aplicaciones de alta carga con IA
- Optimización de grupos de nodos heterogéneos
- Aplicación de ML en entornos multitenant
Resumen y Próximos Pasos
Requerimientos
- Comprensión de los fundamentos de Kubernetes
- Experiencia en despliegues de aplicaciones en contenedores
- Conocimiento de operaciones de clúster y gestión de recursos
Público Objetivo
- SREs que trabajan con sistemas distribuidos a gran escala
- Operadores de Kubernetes que gestionan cargas de trabajo de alta demanda
- Ingenieros de plataforma que optimizan la infraestructura de cómputo
Reseñas (2)
Como mencioné anteriormente, para una persona como yo (sin experiencia), esto supuso una puerta de entrada para comprender las funciones y características de estos programas, herramientas y demás.
Patrick V. Duylovski - UBB + DZI (KBC GROUP)
Curso - Docker and Kubernetes
Traducción Automática
comprensión básica de contenedores/kubernetes y su interacción características de la plataforma Openshift
Eric Scholze - NOW IT GmbH
Curso - Introduction to Containers, Kubernetes & OpenShift
Traducción Automática