Gracias por enviar su consulta! Uno de los miembros de nuestro equipo se pondrá en contacto con usted en breve.
Gracias por enviar su reserva! Uno de los miembros de nuestro equipo se pondrá en contacto con usted en breve.
Duración 35 horas
Temario del curso
Introducción y fundamentos del diagnóstico
- Resumen de los modos de fallo en sistemas LLM y problemas específicos de Ollama
- Establecimiento de experimentos reproducibles y entornos controlados
- Conjunto de herramientas de depuración: registros locales, capturas de solicitud/respuesta y uso de entornos de pruebas aislados (sandboxing)
Reproducción e identificación de fallos
- Técnicas para crear ejemplos mínimos de fallo y semillas
- Interacciones con estado frente a sin estado: aislamiento de errores relacionados con el contexto
- Determinismo, aleatoriedad y control del comportamiento no determinista
Evaluación del comportamiento y métricas
- Métricas cuantitativas: precisión, variantes de ROUGE/BLEU, calibración y proxies de perplejidad
- Evaluaciones cualitativas: puntuación con intervención humana y diseño de rúbricas
- Comprobaciones de fidelidad específicas para tareas y criterios de aceptación
Pruebas automatizadas y regresión
- Pruebas unitarias para prompts y componentes, pruebas de escenarios y de extremo a extremo
- Creación de suites de regresión y líneas base de ejemplos dorados
- Integración CI/CD para actualizaciones de modelos Ollama y puertas de validación automatizadas
Observabilidad y monitoreo
- Registro estructurado, trazas distribuidas e IDs de correlación
- Métricas operativas clave: latencia, uso de tokens, tasas de error y señales de calidad
- Alertas, tableros de control (dashboards) y SLIs/SLOs para servicios respaldados por modelos
Análisis avanzado de la causa raíz
- Seguimiento a través de prompts graficados, llamadas a herramientas y flujos de varios turnos
- Diagnóstico comparativo A/B y estudios de ablación
- Procedencia de los datos, depuración de conjuntos de datos y abordaje de fallos inducidos por el dataset
Seguridad, robustez y estrategias de remediación
- Mitigaciones: filtrado, anclaje (grounding), aumento mediante recuperación (RAG) y andamiaje de prompts
- Patrones de retroceso (rollback), implementación canary y despliegue gradual para actualizaciones de modelos
- Autopsias de incidencias, lecciones aprendidas y ciclos de mejora continua
Resumen y próximos pasos
Requerimientos
- Sólida experiencia en la construcción e implementación de aplicaciones LLM
- Conocimiento de los flujos de trabajo de Ollama y el alojamiento de modelos
- Dominio de Python, Docker y herramientas básicas de observabilidad
Público objetivo
- Ingenieros de IA
- Profesionales de MLOps
- Equipos de QA responsables de sistemas LLM en producción