Uma Mukkara
COO @ MayaData
A principal tarefa dos SREs é manter as operações em funcionamento. Um SRE que trabalha com Kubernetes enfrenta muitos desafios para manter a resiliência no nível desejado e melhorá-la ao longo do tempo. Nesta palestra, abordaremos técnicas para medir e melhorar a resiliência das plataformas Kubernetes de uma maneira Cloud-Native.
O número de microsserviços em um ambiente Kubernetes pode facilmente crescer para centenas. A atualização contínua desses microsserviços e da própria plataforma Kubernetes exigirá um sistema para medir a resiliência do deployment. Os SREs precisam praticar engenharia do caos de uma maneira cloud native, de forma que seja facilmente gerenciável, reutilizando o máximo possível de experimentos de caos e fluxos de trabalho.
Esta palestra é destinada àqueles SREs que gostariam de praticar ou já estão praticando engenharia do caos em seus ambientes. Nesta apresentação, introduziremos o chaos hub para SRE e discutiremos como construir fluxos de trabalho complexos de caos usando os projetos Litmus e Argo. Uma demonstração ao vivo levará o público pela construção de um fluxo de trabalho de caos de ponta a ponta envolvendo falha de nó do Kubernetes, um consumo excessivo de CPU, lentidão na rede em uma aplicação de e-commerce e como a resiliência é medida e monitorada durante esse processo.
—
🥇 Patrocinadores Ouro:
LightStep
Google
🥈 Patrocinadores Prata:
MayaData
Aval Digital Labs
Elastic
The Pathwayz Group
🤝 Parceiro de Mídia
JetBrains
—
0:00 Introdução
0:35 Palestra
—
Entre em contato 📧📭 mark@conf42.com