Uma Mukkara
COO @ MayaData
La tarea principal de los SRE es mantener las operaciones en funcionamiento. Un SRE que trabaja con Kubernetes enfrenta muchos desafíos para mantener la resiliencia en el nivel deseado y mejorar con el tiempo. En esta charla, revisaremos técnicas para medir y mejorar la resiliencia de las plataformas Kubernetes de manera Cloud-Native.
El número de microservicios en un entorno Kubernetes puede crecer fácilmente hasta cientos. La actualización continua de estos microservicios y de la plataforma Kubernetes en sí requerirá un sistema para medir la resiliencia del despliegue. Los SRE necesitan practicar ingeniería del caos de una manera Cloud-Native, de tal forma que sea fácilmente manejable y reutilice tantos experimentos de caos y flujos de trabajo como sea posible.
Esta charla está destinada a aquellos SRE que deseen practicar o ya estén practicando ingeniería del caos en sus entornos. En esta charla, presentaremos Chaos Hub para SRE y discutiremos cómo construir flujos de trabajo de caos complejos utilizando los proyectos Litmus y Argo. Una demostración en vivo llevará a la audiencia a través de la construcción de un flujo de trabajo de caos de extremo a extremo que involucra fallos en nodos de Kubernetes, un consumo excesivo de CPU, una lentitud en la red en una aplicación de comercio electrónico y cómo se mide y monitorea la resiliencia durante este proceso.
—
🥇 Patrocinadores Oro:
LightStep
Google
🥈 Patrocinadores Plata:
MayaData
Aval Digital Labs
Elastic
The Pathwayz Group
🤝 Socio de Medios
JetBrains
—
0:00 Introducción
0:35 Charla
—
Contáctanos 📧📭 mark@conf42.com