Uma Mukkara
COO @ MayaData
La tâche principale des SRE est de maintenir les opérations en cours. Un SRE travaillant avec Kubernetes fait face à de nombreux défis pour maintenir la résilience au niveau souhaité et l'améliorer au fil du temps. Dans cette présentation, nous passerons en revue des techniques pour mesurer et améliorer la résilience des plateformes Kubernetes de manière Cloud-Native.
Le nombre de microservices dans un environnement Kubernetes peut facilement atteindre des centaines. La mise à jour continue de ces microservices et de la plateforme Kubernetes elle-même nécessitera un système pour mesurer la résilience du déploiement. Les SRE doivent pratiquer l'ingénierie du chaos de manière Cloud-Native, de sorte que cela soit facilement gérable et réutilise autant d'expériences et de flux de travail de chaos que possible.
Cette présentation s'adresse aux SRE qui souhaitent pratiquer ou qui pratiquent déjà l'ingénierie du chaos dans leurs environnements. Dans cette présentation, nous introduirons le chaos hub pour SRE et discuterons de la manière de construire des flux de travail de chaos complexes en utilisant les projets Litmus et Argo. Une démonstration en direct guidera le public à travers la construction d'un flux de travail de chaos de bout en bout impliquant une défaillance de nœud Kubernetes, un hog CPU, une lenteur réseau dans une application e-commerce et comment la résilience est mesurée et surveillée pendant ce processus.
—
🥇 Sponsors Or :
LightStep
Google
🥈 Sponsors Argent :
MayaData
Aval Digital Labs
Elastic
The Pathwayz Group
🤝 Partenaire Média
JetBrains
—
0:00 Intro
0:35 Présentation
—
Contact 📧📭 mark@conf42.com