Uma Mukkara
COO @ MayaData
Die Hauptaufgabe von SREs besteht darin, den Betrieb am Laufen zu halten. Ein SRE, der mit Kubernetes arbeitet, hat viele Herausforderungen, um die Resilienz auf dem gewünschten Niveau zu halten und im Laufe der Zeit zu verbessern. In diesem Vortrag werden wir Techniken durchgehen, um die Resilienz von Kubernetes-Plattformen auf eine Cloud-Native-Art zu messen und zu verbessern.
Die Anzahl der Mikrodienste in einer Kubernetes-Umgebung kann leicht in die Hunderte wachsen. Die kontinuierliche Aktualisierung dieser Mikrodienste und der Kubernetes-Plattform selbst erfordert ein System zur Messung der Resilienz des Deployments. SREs müssen Chaos Engineering auf eine cloudnative Weise praktizieren, sodass es leicht verwaltbar ist und so viele Chaos-Experimente und Workflows wie möglich wiederverwendet werden.
Dieser Vortrag richtet sich an SREs, die Chaos Engineering in ihren Umgebungen praktizieren oder dies gerne tun würden. In diesem Vortrag werden wir den Chaos Hub für SRE vorstellen und diskutieren, wie man komplexe Chaos-Workflows mit den Projekten Litmus und Argo erstellt. Eine Live-Demo wird das Publikum durch den Aufbau eines End-to-End-Chaos-Workflows führen, der einen Kubernetes-Knotenfehler, einen CPU-Hog, eine Netzwerkverlangsamung in einer E-Commerce-Anwendung umfasst und wie die Resilienz während dieses Prozesses gemessen und überwacht wird.
—
🥇 Gold Sponsoren:
LightStep
Google
🥈 Silber Sponsoren:
MayaData
Aval Digital Labs
Elastic
The Pathwayz Group
🤝 Medienpartner
JetBrains
—
0:00 Intro
0:35 Vortrag
—
Kontakt 📧📭 mark@conf42.com